Modellkatalógus
AI képmodelek, leírva, nem rangsorolva
Hét modell, amelyet az emberek tényleg név szerint emlegetnek — és hogy valójában mire jó mindegyik. Nincsenek pontszámok, mert a válasz teljesen attól függ, milyen feladattal jött.
A katalógus
- GoogleNano BananaA Google beszélgetésalapú képszerkesztője. Az arcot következetesen megőrzi a módosítások során.
- Stability AIStable DiffusionA nyílt modell, amelyből az egész ökoszisztéma kinőtt. LoRA-k, ControlNet, checkpointok.
- Black Forest LabsFLUX.1Egykori Stable Diffusion-kutatók építették. A promptokat szó szerint követi, szöveget is renderel.
- Midjourney, Inc.MidjourneyEnnek van saját, felismerhető stílusa. Markáns, zárt, csak előfizetéssel.
- RecraftRecraftEz ad ki valódi vektorokat. Márkaépítéshez és designmunkához készült.
- ByteDanceSeedreamA ByteDance modellje. Erős kétnyelvű szövegmegjelenítés és nagy natív felbontás.
- OpenAIgpt-image-1A ChatGPT-ben látható képek mögötti modell. Jól követi az utasításokat, és jól ír ki szöveget a képre.
Hogyan válasszon közöttük
A legtöbbet eldöntő kérdés az, hogy képet készít vagy képet módosít. A semmiből való képkészítés a kompozíciót és a prompt pontos követését jutalmazza; egy fénykép módosítása azt a modellt, amely érintetlenül hagyja mindazt, amit nem említett. Ezek majdnem ellentétes követelmények, és ami az egyikre épült, a másikban többnyire közepes.
A második kérdés a reprodukálhatóság. A zárt, hosztolt modellek a háttérben változnak, és egy megjelenés, amelyre üzletszerűen támaszkodik, olyan ütemezés szerint tűnhet el, amelyre nincs ráhatása. A nyílt weights ezt rögzíti, cserébe az infrastruktúrát Önnek kell futtatnia.
A harmadik a kimeneti formátum — és ezt fedezik fel a legtöbben túl későn. Ha a fájlnak vektorszerkesztőben kell nyílnia, vagy két méteren kell nyomtatódnia, ez a kényszer a minőségi kérdések előtt kiszórja a lista nagy részét.
Mi ez a katalógus
- Tételek
- Hét modell
- Rangsor
- Nem — leíró jellegű
- Kapcsolat
- Nincs egyikhez sem
- Árazás
- Szándékosan nem szerepel
- Verziók
- Nincsenek rögzítve — túl gyorsan változnak
- Frissítve
- 2026. augusztus
Hogyan olvasson modell-összehasonlítást
A legtöbb rangsor olyan kérdésre felel, amit Ön nem tett fel
A „legjobb képgenerátor” listák rendszerint ugyanazt a maroknyi promptot futtatják végig mindenen, majd az eredményeket értékelik. Ez azt méri, az adott modellek hogyan kezelik éppen ezeket a promtokat — és csak akkor hasznos, ha az Ön feladata ezekre hasonlít. A blogposztban jól mutató teszt-promtok ritkán ilyenek.
Hasznosabb a szerkezeti kérdés: képet készít vagy meglévőt módosít, van-e karakteres esztétikája, futtatható-e saját környezetben, és mi jön ki a végén — pixelek vagy görbék. Ezek a tulajdonságok a következő kiadással sem változnak, és minőségi vita előtt kiszórják a lista nagy részét.

Három kérdés, ami gyorsan leszűkíti a kört
Előbb válasszon korlát alapján, csak utána minőség szerint
Az első, legnagyobb elágazás
Leírásból képet generálni és meglévő fotót szerkeszteni szinte ellentétes probléma. Az egyik a kompozíciót és a prompt pontos követését jutalmazza; a másik azt, hogy a nem említett részek érintetlenek maradjanak.
A szerkesztésre épített modellek tartják egy alany identitását egymást követő módosítások alatt. A generálásra építettek a semmiből adnak kontrollt a beállítás, az optika és a stílus felett. Kevés olyan van, ami mindkettőben kiváló.
- Meglévő fotó szerkesztése: Nano Banana.
- Kép készítése a semmiből: FLUX, Midjourney.
- Mindkettő, beszélgetve: gpt-image-1.

Ki irányítja az eszközt, amire támaszkodik
A zárt, hosztolt modellek Ön alatt változnak. Egy megjelenés, amire márkát épített, reprodukálhatatlanná válhat egy Ön által nem szabályozott ütemben, és nincs mit verzióra rögzíteni.
A nyílt súlyok ezt megoldják, cserébe az infrastruktúrát Önre bízzák — hardver, tárhely, frissítések és egy pipeline, ami egy függőség mozdulására eltörhet.
- Fontos az újragyárthatóság: Stable Diffusion, FLUX.
- Nincs infrastruktúra-étvágy: bármely hosztolt megoldás.
- A volumen és az adatvédelem az önhosztolás felé tol.

A korlát, amire a legtöbben a végén jönnek rá
Ha a kimenetnek vektorszerkesztőben kell nyílnia, épületméretre kell skáláznia, vagy jövőre másnak kell újraszíneznie, a raszterkép rossz artefaktum, bármilyen jól is néz ki.
Ugyanígy, ha olvasható szöveget kell hordoznia több ezer karakteres nyelven, a legtöbb megoldás már a legelején kiesik.
- Szerkeszthető görbék: Recraft.
- Kínai és angol szöveg: Seedream.
- Minden más: raszterkép.

Modellekkel kapcsolatos kérdések
Amit a választás előtt szoktak kérdezni
Rövid válaszok; a hosszabb magyarázat minden modell saját oldalán.
Miért ad ugyanaz a prompt és modell más képet?
Mert a kiinduló zaj eltér. Egy seed rögzíti ezt a zajt, és a prompt + seed + modell hármasa pontosan reprodukál egy képet. Ha bármelyiket megváltoztatja, rokon, de nem azonos eredményt kap.
Az újabb modell mindig jobb?
Nyers kimeneten többnyire igen. A körítésben — közösségi eszközök, stílusadapterek, licenc-tisztaság, árstabilitás — gyakran nem. A Stable Diffusion a legjobb példa egy régebbi modellre, amit az ökoszisztémája tart életben.
Át tudom vinni a promptjaimat modellek között?
A téma és a jelenet átvihető; a paraméterek és a szintaxis ritkán. A modellek eltérően értelmezik a súlyozást, a negatívokat és a stílus-tokeneket; ami az egyikre keményen hangolt prompt, a másikra többnyire túlspecifikált.
Mit ad a nyílt súlyú modell valójában?
A lehetőséget, hogy helyben futtassa, egy verziót örökre rögzítsen, képenkénti költség nélkül generáljon, és az alapanyagot távol tartsa harmadik felek infrastruktúrájától. Ennek ára a hardver és a karbantartás.
Melyik írja rendesen a szöveget a képre?
Több már elboldogul rövid sztringekkel, de egyik sem helyettesíti a tipográfiát. Generálja a képet, a szöveget tegye rá dizájneszközben — így elkerül egy teljes problémakategóriát.
A modell fontosabb, mint a prompt?
Egy szint alatt nem. Egy konkrét prompt egy középkategóriás modellen jobb eredményt ad, mint egy ködös a legjobbon — ezért hosszabb a prompt-útmutató, mint ez a katalógus.

Olvassa el ezután
Merre tovább a katalógusból
Fedezzen fel többet
A LaFoto máshol
A katalógus az eszközöket írja le; ezek pedig azok, amiket velük csinál.
- átméretezés pontos pixelméretre
- képformátum konvertálása
- képtömörítő
- kép kivágása
- színek kinyerése egy képből
- háttér eltávolítása
- EXIF-megjelenítő
- AI promptgenerátor
- anime AI generátor
- kép rajzfilmesítése
- pixel art generátor
- melyik generátort érdemes választani
- összevetve a Midjourney-jel
- összevetve a Leonardo AI-val
- Ideogram alternatíva
- Canva alternatíva képekhez
- seedek magyarázata
- mi az a denoise erősség
- szerkesztés maszkon belül
- a LaFoto blogja
Kérdések az AI képmodelekről
- Melyik a legjobb AI képi modell?
- Nincs egyetlen válasz, ezért ez a könyvtár leír, nem rangsorol. A Midjourney esztétikát kényszerít, a FLUX szó szerint veszi az utasítást, a Nano Banana úgy szerkeszt fényképet, hogy az alany ne vesszen el benne, a Stable Diffusion az alkatrészeket adja a kezébe, a Recraft vektort ad ki, a Seedream kínai és angol szedést készít, a gpt-image-1 pedig bonyolult mondatot is jól értelmez. Aszerint válasszon, melyik írja le az Ön problémáját.
- Mi a különbség a nyílt és a zárt modell között?
- A nyílt súlyok letölthetők és futtathatók saját hardveren, így egy verziót végleg rögzíthet, képenkénti költség nélkül generálhat, és a forrásanyagot távol tarthatja harmadik felek szervereitől. A zárt modellekhez API-n vagy alkalmazáson át fér hozzá, nem igényelnek infrastruktúrát, és a szolgáltató ütemezése szerint, nem az Öné szerint változnak.
- Miért nem szerepelnek árak vagy verziószámok ezeken az oldalakon?
- Mert mindkettő gyorsabban változik, mint ahogy egy könyvtároldal frissülni tudna, és egy elavult szám hazugságnak hat, nem elavulásnak. Itt az marad, ami tartós — ki készíti, hogyan érhető el, nyíltak-e a súlyok, és mire tervezték jónak.
- A LaFoto kapcsolatban áll bármelyik modellel?
- Nem. Egyiket sem viszontértékesítjük, és nincs kereskedelmi kapcsolatunk a készítőikkel. Egyetlen helyen szólalunk meg első személyben, a FLUX-bejegyzésben, ahol jelezzük, melyik modell generálta az oldal saját képi anyagát — ezt a galéria kártyáról kártyára igazolja.
- Átvihetek egy promptot egyik modellből a másikba?
- A téma és a jelenet átvihető; a paraméterek és a szintaxis ritkán. A modellek eltérően értelmezik a súlyozást, a negatívokat és a stílus tokeneket, és egy modellre keményen hangolt prompt rendszerint túlspecifikált lesz egy másikhoz.
- Újabb modell mindig jobb a réginél?
- Nyers kimeneti minőségben többnyire igen. Minden, ami körülötte van — közösségi eszköztár, stílusadapterek, licenc-átláthatóság — gyakran nem. A Stable Diffusion a legjobb példa egy régebbi modellre, amelyet nem az eredményei, hanem az ökoszisztémája tart relevánsan.
- Melyik modellt használjam egy meglévő fotó szerkesztésére?
- Olyat, amely szerkesztésre készült, nem generálásra. A megkülönböztető képesség az, hogy egymást követő változtatások mellett is felismerhetően állandóan tartja az alanyt — a legtöbb szöveg–kép modell ezt egy-két szerkesztés után elveszti.
- Bármelyikük megbízhatóan renderel szöveget?
- Több modell is elboldogul rövid sztringekkel úgy, hogy lehet rájuk tervezni, de egyik sem helyettesíti a tördelést. Generálja meg a képet, és a szöveget adja hozzá tervezőeszközben — a generált betűzés utólag nem szerkeszthető, nem ellenőrizhető a helyesírása és nem fordítható.
További olvasnivaló
Kezdjen alkotni még ma
Generálja le első képét a legjobb AI képgenerátorral.
Egy mondatból másodpercek alatt kész, fotórealisztikus kép — majd finomítsa a részleteket. Nincs setup, nincs Discord, nincs GPU.
Csatlakozzon 4200+ alkotóhoz, akik a LaFotót használják