Przewodnik
Jak pisać prompty do zdjęć AI, które naprawdę działają

Z czego składa się mocny prompt do zdjęcia AI?
Każdy skuteczny prompt powstaje z tych samych warstw, od najważniejszej do najmniej ważnej. Proszę myśleć o tym jak o briefie dla fotografa, który Państwa nie zna: najpierw opisujemy temat, a potem budujemy wokół niego świat.
- Temat: element absolutnie kluczowy. „Szczeniak golden retrievera”, „ceramiczny kubek do kawy”, „kobieta po sześćdziesiątce”.
- Cechy kluczowe: detale, które uszczegóławiają temat. Wiek, wyraz twarzy, ubranie, materiał, kolor, poza.
- Sceneria / środowisko: gdzie to się dzieje. „Na mokrej od deszczu ulicy”, „na marmurowym blacie kuchennym”, „w mglistej sosnowej puszczy”.
- Oświetlenie: prawdopodobnie najważniejsza dźwignia nastroju i realizmu. „Miękkie światło z okna”, „złota godzina pod światło”, „studyjne światło obrysowe”.
- Aparat, obiektyw i styl: „na obiektywie 50mm”, „mała głębia ostrości”, „edytorialowa fotografia mody”, „ziarno filmu”.
- Nastrój: rejestr emocjonalny. „Spokojny i cichy”, „energiczny i zabawny”, „mroczny i filmowy”.
- Kwalifikatory techniczne: rozdzielczość, szczegółowość i format. „Wysoki detal”, „ostry”, „4k”.
Obok promptu działają jeszcze dwa pokrętła. Negatywny prompt wylicza, czego unikać, np. „rozmyte, dodatkowe palce, tekst, znak wodny, przesycone”. Proporcje obrazu ustawiają kadr: 1:1 do kwadratowych postów, 4:5 do pionowych feedów, 16:9 do pejzaży i bannerów, 9:16 do stories i reels.
Nie trzeba pisać każdej warstwy dla każdego obrazu, ale ten porządek sprawia, że generator zdjęć AI czyta zamiar w tej samej hierarchii, w jakiej Państwo myślą. Jeśli wolą Państwo pominąć ręczne układanie, Generator promptów AI zbuduje pełny prompt z krótkiej myśli.
Dlaczego konkret wygrywa z długością?
Długie prompty wydają się wyczerpujące, ale długość to nie kontrola. Ściana przymiotników często sobie przeczy, a model uśrednia konflikt do czegoś rozmytego. Konkretne rzeczowniki i kilka zdecydowanych modyfikatorów prowadzą znacznie pewniej.
Proszę porównać „beautiful amazing stunning gorgeous high quality professional photo of a nice dog” z „mokry czarny labrador strzepujący wodę w ruchu, podświetlony niskim popołudniowym słońcem od tyłu”. Drugi opis jest krótszy, a daje generatorowi obrazów AI wyraźną scenę do zbudowania. Mgliste superlatywy typu „piękne” czy „wysokiej jakości” wyrażają oczekiwania, a nie obraz.
Przydatna zasada: każde słowo powinno zmieniać obraz. Jeśli usunięcie słowa nie zmieniłoby oczekiwanego efektu, to zapewne wypełniacz. Zamiast „ładne tło” proszę napisać „rozmyte zielone tło parku” — życzenie zamienia się w wskazówkę.
Jak iterować, nie tracąc kontroli?
Najczęstszy błąd po wyniku „prawie trafionym” to przepisanie całego promptu. Kolejna generacja różni się wtedy w pięciu aspektach i nie wiadomo, co pomogło. Proszę traktować promptowanie jak eksperyment kontrolowany: zmieniać jeden parametr naraz.
Jeśli kompozycja jest dobra, ale oświetlenie płaskie — proszę zmienić wyłącznie fragment o oświetleniu. Jeśli nastrój jest trafiony, ale ubranie bohatera nie — proszę edytować tylko tę cechę. Reszta bez zmian, łącznie z seed, jeśli narzędzie go udostępnia, żeby różnica w obrazie była dokładnie Państwa zmianą.
- Runda 1: ustawić temat i kompozycję; bez dopieszczania.
- Runda 2: skorygować oświetlenie i porę dnia.
- Runda 3: dopracować aparat, obiektyw i styl.
- Runda 4: dostroić nastrój i kolor, potem zablokować proporcje obrazu.
Takie etapowanie zamienia frustrujący „jednoręki bandyta” w powtarzalny proces, którego można nauczyć każdego.
Jak wyglądają mocne przykładowe prompty według zastosowań?
To są szablony i rusztowania, nie gwarancje. Każdy pokazuje, jak zastosować anatomię do konkretnego zadania. Proszę skopiować, podmienić elementy w nawiasach na własne i iterować. Wyniki zależą od narzędzia i modelu, więc traktujmy je jako mocne starty, nie sztywne receptury.
Portrety:
- "Headshot kobiety po trzydziestce, naturalny makijaż, miękki pewny uśmiech, w grafitowej marynarce, siedząca na neutralnym szarym tle, miękkie rozproszone światło z okna z lewej, obiektyw 85mm, mała głębia ostrości, profesjonalny portret korporacyjny, ciepły i przystępny nastrój, ostry. Negatywny: twarde cienie, niedoskonałości skóry, tekst, znak wodny. Proporcje 4:5."
- "Portret środowiskowy szefa kuchni w białej kurtce, około 45 lat, ręce skrzyżowane, stojącego w ruchliwej stalowej kuchni z bokeh w tle, ciepłe światło wolframowe z parą w powietrzu, 35mm, dokumentalny edytorial, nastrój naturalny i dumny, wysoki detal. Negatywny: rozmycie, zniekształcone dłonie. Proporcje 3:2."
Zdjęcia produktowe:
- "Buteleczka do pielęgnacji z brązowego szkła z matową czarną pompką, wycentrowana na mokrej, wypolerowanej płycie z betonu, pojedyncze miękkie światło studyjne z góry z delikatnym gradientem tła, obiektyw makro 100mm, czysty minimalistyczny styl e-commerce, premium i spokojny nastrój, ostre refleksy, wysoki detal. Negatywny: bałagan, tekst, odciski palców, ostry blik. Proporcje 1:1."
- "Stos trzech rzemieślniczych tabliczek czekolady w papierze kraft na rustykalnej drewnianej desce, rozsypane nibsy kakao dookoła, ciepłe boczne światło z prawej z miękkimi cieniami, 50mm, mała głębia ostrości, lifestyle’owa fotografia jedzenia, przytulny i rozpieszczający nastrój. Negatywny: plastikowy look, przesycenie, znak wodny. Proporcje 4:5."
Krajobrazy i miejsca:
- "Mglista alpejska tafla jeziora o wschodzie słońca, ośnieżone szczyty odbite w nieruchomej wodzie, samotna drewniana łódź wiosłowa przy brzegu, miękkie światło złotej godziny przebijające się przez niską mgłę, szeroki kąt 24mm, duża głębia ostrości, nastrojowo spokojny i przestrzenny kadr, drobny detal. Negatywny: ludzie, budynki, rozmycie, przesycenie. Proporcje 16:9."
- "Wąska brukowana uliczka w starym europejskim miasteczku o zmierzchu, ciepło jarzące się witryny sklepów, mokłe kamienie odbijają bursztynowe latarnie, lekki deszcz, 35mm, filmowa, nastrojowa atmosfera, nostalgiczny klimat, wysoki detal. Negatywny: nowoczesne auta, szyldy z tekstem, zniekształcona perspektywa. Proporcje 16:9."
Editorial i lifestyle:
- "Młoda para śmiejąca się podczas wspólnego gotowania w nasłonecznionej nowoczesnej kuchni, swobodne lniane ubrania, świeże warzywa na blacie, miękkie naturalne światło dzienne z dużych okien, 35mm, reportażowy styl lifestyle editorial, ciepły i radosny nastrój, naturalne odcienie skóry, wysoki detal. Negatywny: sztywne pozowanie, rozmycie, tekst. Proporcje 3:2."
- "Edytorial modowy: modelka w powłóczystej czerwonej sukni na wietrznym dachu o złotej godzinie, dramatyczna panorama miasta w tle, włosy uchwycone w ruchu, niskie światło pod słońce tworzące poświatę na krawędziach, 70mm, styl wysokiej mody z magazynu, odważny i pewny nastrój. Negatywny: dodatkowe kończyny, znak wodny, mdłe światło. Proporcje 4:5."
Media społecznościowe:
- "Flat-lay: mrożona matcha latte, notes i okulary przeciwsłoneczne na pastelowo różowej powierzchni, jasne równomierne światło z góry, widok top-down 50mm, energetyczna, modna estetyka Instagram, świeży i zabawny nastrój, wyraźny detal. Negatywny: cienie, bałagan, tekst. Proporcje 1:1."
- "Pionowy kadr całej sylwetki influencera streetwear opierającego się o ścianę z graffiti, oversize’owa bluza i masywne sneakersy, miękkie światło dzienne spod chmur, 35mm, miejski styl edytorialowy, chłodny i niewymuszony nastrój, wysoki detal. Negatywny: rozmycie, zniekształcone buty, znak wodny. Proporcje 9:16."
Jeśli wolą Państwo zacząć od zdania zamiast struktury, Tekst na zdjęcie przyjmie zwykły opis i zajmie się renderowaniem — to szybki sposób, by sprawdzić, czy temat i sceneria są czytelne, zanim doda się szlify.
Słabe vs mocne: jak wygląda realny upgrade?
Najszybciej uczymy się promptowania, oglądając przeróbki słabych promptów obok wersji poprawionych. Każdy wiersz poniżej pokazuje, czemu oryginał zawodzi i jak go naprawić.
| Słaby prompt | Dlaczego nie działa | Mocny prompt |
|---|---|---|
| pies | Brak cech, scenerii i światła; model wymyśla wszystko sam | mokry czarny labrador strzepujący wodę w ruchu na plaży, podświetlony niskim popołudniowym słońcem, obiektyw 70mm, mała głębia ostrości, energetyczny nastrój |
| portret pięknej kobiety | „Beautiful” to subiektywny wypełniacz; brak wieku, oświetlenia i kadrowania | headshot kobiety po trzydziestce, miękki pewny uśmiech, neutralne szare tło, miękkie światło z okna z lewej, obiektyw 85mm, profesjonalny portret korporacyjny, 4:5 |
| produkt na białym tle | Ogólnik; brak materiału, oświetlenia i obiektywu, więc wygląda jak płaska stockowa grafika | butelka do pielęgnacji z brązowego szkła z matową czarną pompką, wycentrowana na mokrym wypolerowanym betonie, miękkie światło studyjne z góry, obiektyw makro 100mm, minimalistyczny styl e-commerce premium, 1:1 |
| ładny krajobraz | Brak miejsca, pory dnia i kompozycji; wynik to zapomniany średniak | mglista alpejska tafla jeziora o wschodzie słońca, ośnieżone szczyty odbite w nieruchomej wodzie, światło złotej godziny przez niską mgłę, szeroki kąt 24mm, spokojny nastrój, 16:9 |
| wysokiej jakości zdjęcie jedzenia, bardzo szczegółowe, profesjonalne | Nałożone słowa o jakości bez realnego tematu i sceny | stos rzemieślniczych tabliczek czekolady w papierze kraft na rustykalnej desce, rozsypane nibsy kakao, ciepłe światło boczne, 50mm, przytulna lifestyle’owa fotografia jedzenia, 4:5 |
| klimatyczne miasto nocą | Mgliste słowo o nastroju, brak konkretów; światło i miejsce zdane na los | wąska brukowana uliczka o zmierzchu, żarzące się witryny sklepów, mokre kamienie odbijają bursztynowe latarnie, lekki deszcz, 35mm, filmowa nastrojowa atmosfera, 16:9 |
Najczęstsze błędy w promptach
- Piętrzenie słów o jakości. „Best, amazing, ultra high quality, professional” to szum, nie wskazówka. Lepiej opisać scenę.
- Sprzeczności w treści. „Minimalistyczne, ale bardzo szczegółowe maksymalistyczne” zmusza model do uśrednienia przeciwieństw.
- Pomijanie oświetlenia. To ono najmocniej kształtuje realizm i nastrój; bez niego obraz bywa płaski.
- Ignorowanie negatywnych promptów. Jeśli ciągle pojawiają się nakładki tekstu, dodatkowe palce czy przesycenie — proszę je jawnie wykluczyć.
- Zapominanie o proporcjach obrazu. Kwadratowy kadr przy pejzażu marnuje kompozycję; proszę ustawić proporcje świadomie.
- Przeładowanie jednego promptu. Dwadzieścia konkurujących detali to chaos. Najpierw esencja, potem precyzja przez iteracje.
- Nieprecyzyjny temat. „Osoba” niczego nie kotwiczy; proszę doprecyzować wiek, strój, wyraz twarzy i pozę.
Jak dopracować wynik bez losowania od zera?
Gdy generacja jest na 90% trafiona, warto powstrzymać się przed startem od nowa. Ponowne losowanie wyrzuca to, co dobre. Lepiej poprawiać celowo.
- Wydzielić problem. Nazwać dokładnie, co jest nie tak: „zniekształcone dłonie”, „zbyt chłodne światło”, „zagracone tło”.
- Skorygować jedną frazę. Edytować tylko właściwą część promptu i wygenerować ponownie; porównać z poprzednią wersją.
- Odjąć przez negatywny prompt. Dodać niechciany element do negatywów zamiast przepisywać całość.
- Edytować gotowe zdjęcie. Wiele narzędzi pozwala poprawić pojedynczy element bezpośrednio — podmienić tło, usunąć obiekt, zmienić oświetlenie — żeby zachować kompozycję, którą już Państwo lubią, zamiast ryzykować nowy rzut.
Edycja wygrywa z losowaniem od nowa wszędzie tam, gdzie problem jest lokalny, a reszta obrazu dobra. Pełny re-prompt warto robić tylko wtedy, gdy mylony jest sam koncept. Głębszy opis całego workflow, od pierwszego promptu po finalną edycję, znajduje się w przewodniku po generatorze zdjęć AI.
W skrócie pętla jest prosta: napisać ustrukturyzowany prompt, wygenerować, wyizolować jedną wadę, naprawić ją edycją lub pojedynczą zmianą, powtórzyć. Ta dyscyplina odróżnia przypadkowe trafienia od konsekwentnie świetnych obrazów.
Źródła
- 01Text-to-image model (overview) — Wikipedia (dostęp 2026-06-01)
- 02Prompt engineering — Wikipedia (dostęp 2026-06-01)
- 03Diffusion model — Wikipedia (dostęp 2026-06-01)
Najczęstsze pytania
- Jaka jest podstawowa formuła promptu do zdjęcia AI?
- Temat, potem cechy kluczowe, sceneria, oświetlenie, aparat/obiektyw/styl, nastrój i kwalifikatory techniczne — w kolejności od najważniejszych. Do tego osobny negatywny prompt i ustawione proporcje obrazu dla kadru.
- Czy dłuższe prompty są zawsze lepsze?
- Nie. Konkret bije długość. Krótki prompt pełen rzeczowych rzeczowników i zdecydowanych modyfikatorów zwykle wygrywa z długim, najeżonym pustymi superlatywami. Proszę celować w słowa, które realnie zmieniają obraz.
- Czym jest negatywny prompt?
- To lista elementów, których generator obrazów AI ma unikać, np. rozmyte, dodatkowe palce, tekst, znak wodny czy przesycone. To najszybszy sposób na usunięcie powracających problemów bez przepisywania głównego promptu.
- Jakich proporcji obrazu użyć?
- Dopasować do miejsca publikacji: 1:1 do postów kwadratowych, 4:5 do pionowych feedów i portretów, 16:9 do pejzaży i bannerów, 9:16 do stories i reels. Warto ustawić je świadomie, żeby uniknąć przypadkowych kadrów.
- Dlaczego moje zdjęcia AI są płaskie lub generyczne?
- Najczęściej brakuje konkretnego oświetlenia i precyzyjnego tematu. Proszę dodać określone światło, np. miękkie światło z okna czy złota godzina pod światło, oraz opisać cechy tematu, scenerię i styl aparatu lub obiektywu.
- Jak skutecznie iterować na promptach?
- Zmieniać jeden parametr naraz. Resztę zablokować, łącznie z seed, jeśli narzędzie go oferuje, żeby dokładnie widzieć efekt każdej poprawki. Dopracowywać etapami: najpierw kompozycja, potem światło, potem styl, na końcu nastrój.
- Lepiej losować ponownie czy edytować gotowe zdjęcie?
- Edytować, gdy problem jest lokalny, a reszta dobra — np. poprawiając tło, usuwając obiekt albo zmieniając oświetlenie. Losować od nowa warto tylko wtedy, gdy myli się sam koncept. Edycja zachowuje kompozycję, którą Państwo już lubią.
- Czy te przykładowe prompty gwarantują konkretny wynik?
- Nie. To szablony i rusztowania celujące w opisany wygląd. Efekt zależy od narzędzia, modelu i ustawień, więc najlepiej traktować je jako mocne punkty startu i dopracowywać dalej.
- Czy narzędzie może napisać prompt za mnie?
- Tak. Generator promptów AI zbuduje pełny ustrukturyzowany prompt z krótkiej myśli, a Tekst na zdjęcie pozwala zacząć od zwykłego zdania. Oba sposoby dobrze testują temat i scenerię przed dodaniem szlifów.
- Jaka jest największa dźwignia jakości obrazu?
- Oświetlenie, tuż obok precyzyjnie określonego tematu. Nazwanie źródła światła, kierunku i pory dnia robi dla realizmu i nastroju więcej niż niemal każda inna część promptu.
Napisane przez
Zespół redakcyjny LaFoto tworzy przewodniki i porównania o generowaniu zdjęć AI, trzymając się standardu: wszystko ze źródłem, zero zmyślania.
Czytaj dalej
Zacznij tworzyć dziś
Wygeneruj pierwszy obraz w najlepszym generatorze obrazów AI.
Zamień zdanie w gotowy, fotorealistyczny obraz w kilka sekund — a potem dopracuj każdy szczegół. Bez konfiguracji, bez Discorda, bez GPU.
Dołącz do 4200+ twórców korzystających z LaFoto



