Przejdź do treści
LaFoto

Słowniczek obrazów AI

Słownictwo, którego generator obrazów AI oczekuje, że już Państwo znają

Każdy termin poniżej występuje w prawdziwym interfejsie lub prawdziwym promopcie. Najpierw jedna definicja w jednym zdaniu, bo definicja, którą trzeba czytać dwa razy, zawiodła.

Większość trudności z generowaniem obrazów AI to słownictwo, nie technika. Seed, siła denoise, guidance scale i inpainting opisują konkretne zachowania — kiedy słowo coś znaczy, sterowanie staje się oczywiste. To terminy warte poznania, w kolejności, w jakiej się z nimi spotykamy.

Jak działa generowanie

Dyfuzja
Technika stojąca za większością współczesnych modeli obrazowych: trenowana przez dodawanie szumu do prawdziwych obrazów i uczenie się jego odwracania, a w generacji uruchamiana wspak — od czystego szumu do wyniku.
Tekst na obraz
Generowanie nowego obrazu wyłącznie z opisu słownego, bez obrazu źródłowego. Gdy celem jest fotografia, bywa nazywane też text to photo.
Obraz z obrazu
Generowanie nowego obrazu na podstawie istniejącego plus prompt, przy czym siła denoise kontroluje, jak dużo z oryginału zostanie zachowane.
Checkpoint
Zapisany zestaw wag modelu. Różne checkpointy tej samej architektury dają widocznie odmienne wyniki przy identycznych promptach.

Sterowanie i parametry

Seed
Liczba, która wyznacza początkowy szum, od którego zaczyna się generowanie. Ten sam seed z tym samym promptem i modelem odtwarza ten sam obraz.
Siła denoise
W image-to-image: jak duża część obrazu źródłowego zostaje odrzucona przed ponownym generowaniem. Niskie wartości zachowują oryginał; wysokie traktują go jak luźny punkt odniesienia.
Skala guidance
Jak mocno model jest „pchany” w stronę Twojego promptu na każdym kroku. Zbyt niska wartość sprawia, że model błądzi; zbyt wysoka usztywnia obraz i przepala kolory.
LoRA
Niewielki, wytrenowany dodatek, który uczy bazowy model konkretnego stylu, postaci lub obiektu bez ponownego trenowania całego modelu.
Negatywny prompt
Osobne pole opisujące, czego unikać. Nie wszystkie endpointy je obsługują — tam, gdzie go nie ma, wszystko, co zostanie zapisane, jest instrukcją pozytywną.
Sampler
Algorytm, który prowadzi proces denoise krok po kroku. Różne samplery zbiegają do wyniku w różnym tempie i dają nieco inne rezultaty z tego samego seeda.

Operacje edycji

Inpainting
Ponowna generacja zamaskowanego obszaru wewnątrz obrazu przy pozostawieniu wszystkiego poza maską bez zmian. Podstawa usuwania obiektów i edycji punktowej.
Outpainting
Generowanie nowej treści obrazu poza oryginalnymi krawędziami kadru, używane do rozszerzania fotografii do szerszych proporcji bez kadrowania.

Pliki i wyjście

Proporcje obrazu
Stosunek szerokości do wysokości obrazu, np. 1:1, 4:5 lub 16:9. Wybierasz go przed generowaniem, bo model komponuje pod kadr.
Skalowanie w górę
Powiększanie obrazu poza jego pierwotne wymiary w pikselach. Skalowanie w górę oparte na AI odtwarza wiarygodne detale zamiast interpolować między istniejącymi pikselami.
Kanał alfa
Warstwa przezroczystości w obrazie. PNG i WebP ją obsługują; JPEG nie — dlatego przezroczysty wycinek zapisany jako JPEG dostaje jednolite tło.
EXIF
Metadane osadzone w fotografii, zapisujące aparat, obiektyw, ekspozycję, datę i często współrzędne GPS. Usuwane przy każdym ponownym zakodowaniu pliku.

Jak działa ten słownik

Hasła
Tylko te, które spotyka się w prawdziwym interfejsie
Definicje
Zawsze jedno zdanie na początku
Osobna strona
Tylko gdy akapit nie wystarcza
Schemat
DefinedTermSet, z podlinkowanymi elementami
Aktualizacje
Gdy zmienia się zachowanie modeli
Koszt
Za darmo, bez konta

W praktyce

Większość trudności z obrazami AI to słownictwo

Seed, denoise strength, guidance scale i inpainting nazywają po jednym, konkretnym zachowaniu. Gdy słowo coś znaczy, sterujący nim suwak staje się oczywisty — a do tego czasu interfejs wygląda jak ściana przypadkowych suwaków.

Dlatego najpierw jest definicja, a dopiero potem wyjaśnienie. Definicja, którą trzeba czytać dwa razy, nie spełniła swojego jedynego zadania.

Otwarty podręcznik techniczny na ciepłym papierze z lupą spoczywającą na stronie z diagramami

Trzy sposoby

Od czego zacząć

Jak powstają obrazy

Dyfuzja, tekst na obraz, obraz na obraz i checkpointy. Mechanika wyjaśniająca, dlaczego ten sam prompt daje różne wyniki.

  • Najpierw dyfuzja, potem seed.
  • Tekst na obraz i obraz na obraz to różne tryby.
  • Checkpointy zmieniają wynik bardziej niż prompty.
Wygenerowane przez AI studium portretowe

Szczegóły

Pytania o słownik

Najczęstsze pytania o słownictwo.

Dlaczego ten sam prompt daje różne obrazy

Seed nie był ustalony. Generowanie startuje od losowego szumu, a punkt startowy wpływa na wynik bardziej niż większość zmian promptu.

Do czego służy denoise strength

Ustala, jak dużo obrazu źródłowego przetrwa w generowaniu image-to-image. To najważniejszy suwak w tym trybie.

Różnica między inpainting i outpainting

Inpainting generuje wewnątrz kadru; outpainting — poza jego krawędziami. Ta sama operacja, inny obszar.

Czy seed działa między modelami

Nie. Seed indeksuje przestrzeń szumu jednego modelu, więc ten sam numer gdzie indziej daje coś niepowiązanego.

Dlaczego proporcje obrazu wybiera się najpierw

Model komponuje pod dany kadr, więc kadrowanie po fakcie odrzuca układ, który zaprojektował celowo.

Zdjęcie produktowe wygenerowane przez AI na białym bezszwowym tle

Odkrywaj dalej

W innych działach LaFoto

Każdy termin opisuje coś, co robi jedno z tych narzędzi.

Vocabulary

Pytania o terminy obrazów AI

Czym jest seed w generowaniu obrazów AI?
Seed to liczba ustalająca losowy szum, od którego startuje generowanie. Ten sam seed, prompt i model odtworzą ten sam obraz — dlatego jego utrwalenie jest jedynym sposobem, by sprawdzić, co faktycznie zmieniło pojedyncze słowo.
Co kontroluje siła denoise?
Ile z obrazu źródłowego przetrwa w generowaniu image-to-image. Przy 0.2 fotografia jest zasadniczo nienaruszona; przy 0.5 kompozycja się trzyma, a treść jest negocjowana; przy 0.85 obraz źródłowy jest już głównie zbiorem nastrojów.
Jaka jest różnica między inpainting a outpainting?
Inpainting regeneruje zamaskowany obszar wewnątrz istniejącej ramki; outpainting generuje nową treść poza oryginalnymi krawędziami. To ta sama operacja skierowana w różne miejsca — jedna naprawia, druga rozszerza.
Czym jest guidance scale?
Siłą, z jaką model jest dopychany do Państwa promptu na każdym kroku odszumiania. Zbyt niska — i wynik odchodzi od słów; zbyt wysoka — i obraz staje się sztywny oraz przesycony przez nadkorekcję.
Czym jest LoRA?
Niewielkim, wytrenowanym dodatkiem, który uczy model bazowy jednego konkretnego stylu, postaci lub obiektu bez ponownego trenowania całego modelu. Dzięki temu użytkownicy otwartych modeli uzyskują spójne postacie w wielu obrazach.
Dlaczego proporcje kadru trzeba wybrać przed generowaniem?
Model komponuje pod daną ramkę — układa scenę poziomo dla 16:9 i pionowo dla 4:5. Kadrowanie po fakcie wyrzuca celowo zaprojektowaną kompozycję.
Czym jest kanał alfa?
Warstwą przezroczystości w pliku graficznym. PNG i WebP go obsługują; JPEG — nie, dlatego wycięty obiekt zapisany jako JPEG dostaje białe tło.
Czy seed działa w innym modelu?
Nie. Seed indeksuje przestrzeń szumu jednego konkretnego modelu, więc ten sam numer w innym modelu — a często nawet w innej wersji tego samego modelu — da coś niepowiązanego. Proszę zapisać przy nim także model.

Zacznij tworzyć dziś

Wygeneruj pierwszy obraz w najlepszym generatorze obrazów AI.

Zamień zdanie w gotowy, fotorealistyczny obraz w kilka sekund — a potem dopracuj każdy szczegół. Bez konfiguracji, bez Discorda, bez GPU.

Dołącz do 4200+ twórców korzystających z LaFoto