Přeskočit na obsah
LaFoto

Slovníček AI generování obrázků

Slovník, který AI generátor obrázků očekává, že už znáte

Každý pojem níže se vyskytuje v reálném rozhraní nebo reálném promptu. Každý nejprve definujeme jednou větou, protože definice, kterou musíte číst dvakrát, selhala.

Většina potíží s AI generováním obrázků je spíš o slovníku než o technice. Seed, síla denoise, míra vedení a inpainting každý pojmenovává jedno konkrétní chování — jakmile slovo něco znamená, ovládací prvek je zřejmý. Toto jsou pojmy, které stojí za to znát, v pořadí, v jakém je potkáte.

Jak funguje generování

Difuze
Technika stojící za většinou současných obrazových modelů: trénuje se přidáváním šumu do reálných snímků a učením jeho reverze, při generování pak běží pozpátku od čistého šumu.
Text na obraz
Vygenerování nového obrázku pouze z psaného popisu, bez zdrojové fotografie. Když je cílem realistická fotografie, mluví se i o „text to photo“.
Obraz z obrazu
Vygenerování nového obrázku ze stávajícího plus promptu; míra denoise určuje, kolik ze zdroje se zachová.
Checkpoint
Uložená sada vah modelu. Různé checkpointy téže architektury dávají viditelně odlišný výstup i z identických promptů.

Ovládání a parametry

Seed
Číslo, které určuje počáteční šum, z něhož generování startuje. Stejný seed se stejným promptem a modelem zopakuje stejný obrázek.
Síla odšumu
V image-to-image určuje, kolik z vaší zdrojové fotky se před znovuvygenerováním zahodí. Nízké hodnoty originál zachovají; vysoké z něj dělají volnou referenci.
Síla vedení
Jak silně je model v každém kroku tlačen k vašemu promptu. Při příliš nízké hodnotě se model toulá, při příliš vysoké je výstup strnulý a přesycený barvami.
LoRA
Malý natrénovaný doplněk, který naučí základní model konkrétnímu stylu, postavě či objektu bez přeučení celého modelu.
Negativní prompt
Samostatné pole popisující, čemu se vyhnout. Ne všechny endpointy jej podporují — kde ne, je vše, co napíšete, pozitivní instrukce.
Sampler
Algoritmus, který řídí kroky denoisingu. Různé samplery konvergují různou rychlostí a ze stejného seedu vytvoří mírně odlišné výsledky.

Úpravy

Inpainting
Znovuvygenerování maskované oblasti uvnitř obrázku při zachování všeho mimo masku. Základ odstranění objektů a cílených úprav.
Outpainting
Generování nového obrazového obsahu za původními okraji snímku. Slouží k rozšíření fotografie na širší poměr stran bez ořezu.

Soubory a výstup

Poměr stran
Poměr mezi šířkou a výškou obrázku, například 1:1, 4:5 nebo 16:9. Volí se před generováním, protože model komponuje do daného formátu.
Zvětšování rozlišení (upscale)
Zvětšení obrázku nad jeho původní rozměry v pixelech. AI upscaling místo prosté interpolace dopočítává věrohodné detaily.
Alfa kanál
Vrstva průhlednosti v obrázku. PNG a WebP ji podporují; JPEG nikoli, proto průhledný výřez uložený jako JPEG dostane plné pozadí.
EXIF
Metadata vložená do fotografie, která zaznamenávají fotoaparát, objektiv, expozici, datum a často i GPS souřadnice. Při každém novém překódování souboru se odstraní.

Jak tento glosář funguje

Pojmy
Jen ty, se kterými se setkáte v reálném rozhraní
Definice
Vždy nejprve jednou větou
Vlastní stránka
Jen když odstavec nestačí
Schéma
DefinedTermSet, s odkazy na členy
Aktualizace
Když se chování modelů změní
Cena
Zdarma, bez účtu

V praxi

Většina obtíží s AI obrazem je slovník

Seed, denoise strength, guidance scale a inpainting každý označuje přesně jedno chování. Jakmile pojem něco znamená, ovládací prvek je zřejmý — do té doby vypadá rozhraní jako stěna náhodných jezdců.

Proto zde definice předchází výkladu. Definice, kterou musíte číst dvakrát, selhala v jediném úkolu, který měla.

Otevřená technická příručka na teplém papíře s lupou spočívající na stránce s diagramy

Tři cesty dovnitř

Kde začít

Jak se obrázky tvoří

Diffusion, text to image, image to image a checkpointy. Mechanika, která vysvětluje, proč tentýž prompt dává jiné výsledky.

  • Začněte diffusion, pak seed.
  • Text to image a image to image jsou různé režimy.
  • Checkpointy mění výstup víc než prompty.
AI generovaná portrétní studie

detail

Otázky ke glosáři

Nejčastější slovníkové otázky.

Proč tentýž prompt dává jiné obrázky

Seed nebyl zafixovaný. Generování začíná náhodným šumem a startovní bod ovlivní výsledek víc než většina úprav promptu.

Co dělá denoise strength

Určuje, kolik ze zdrojového obrázku přežije image-to-image generování. Je to nejdůležitější ovladač v tomto režimu.

Rozdíl mezi inpainting a outpainting

Inpainting znovu generuje uvnitř rámu; outpainting generuje za jeho okraji. Stejná operace, jiná oblast.

Zda seed funguje napříč modely

Ne. Seed indexuje do šumového prostoru jednoho modelu, takže stejné číslo jinde vyprodukuje něco nesouvisejícího.

Proč volit poměr stran jako první

Model komponuje pro rám, který dostane, takže ořezem potom zahodíte uspořádání, které záměrně vytvořil.

AI generovaná produktová fotografie na bílém nekonečném pozadí

Objevujte dál

Jinde na LaFoto

Každý zdejší pojem popisuje něco, co některý z těchto nástrojů dělá.

Vocabulary

Dotazy k termínům AI generování obrázků

Co je seed v AI generování obrázků?
Seed je číslo, které určí výchozí náhodný šum, z nějž generace startuje. Stejný seed, prompt a model reprodukují stejný obrázek — proto je jeho fixace jediný způsob, jak otestovat, co skutečně udělala změna jednoho slova.
Co ovládá síla denoise?
Kolik z Vašeho zdrojového snímku přežije při image-to-image generování. Při 0.2 zůstává fotografie v zásadě nedotčená; při 0.5 drží kompozice, ale obsah se přehodnocuje; při 0.85 je zdroj spíš jen moodboard.
Jaký je rozdíl mezi inpainting a outpainting?
Inpainting přegeneruje maskovanou oblast uvnitř stávajícího rámu; outpainting vytvoří nový obsah za původními okraji. Stejná operace mířená na jiná místa — jedna opravuje, druhá rozšiřuje.
Co je naváděcí škála?
Jak silně je model v každém kroku odšumování tlačen směrem k Vašemu promptu. Příliš nízko a od Vašich slov odplouvá; příliš vysoko a výstup ztuhne a přesytí se, jakmile začne překompenzovávat.
Co je LoRA?
Malý natrénovaný doplněk, který naučí základní model jednomu konkrétnímu stylu, postavě nebo objektu bez nutnosti celý model přeškolit. Tak uživatelé otevřených modelů dosahují konzistentních postav napříč mnoha obrázky.
Proč je potřeba volit poměr stran před generováním?
Model komponuje pro rám, který dostane — scénu uspořádá horizontálně pro 16:9 a vertikálně pro 4:5. Ořezem pak zahodíte kompozici, kterou vytvořil záměrně.
Co je alfa kanál?
Vrstva průhlednosti v souboru s obrazem. PNG a WebP jej podporují; JPEG nikoli, proto má vyřezaný subjekt uložený jako JPEG plné bílé pozadí.
Funguje seed i v jiném modelu?
Ne. Seed indexuje šumový prostor jednoho konkrétního modelu, takže stejné číslo v jiném modelu — nebo často i v jiné verzi téhož modelu — dá něco nesouvisejícího. Zapisujte si k němu i použitý model.

Začněte tvořit ještě dnes

Vytvořte svůj první obrázek v nejlepším AI generátoru obrázků.

Větu promění v hotový, fotorealistický obrázek během pár sekund — pak doladíte každý detail. Bez nastavování, bez Discordu, bez GPU.

Připojte se k 4 200+ tvůrcům používajícím LaFoto