Modellkatalog
AI-bildmodeller, beskrivna snarare än rankade
Sju modeller som folk faktiskt nämner — och vad var och en faktiskt är till för. Inga poäng, för svaret beror helt på jobbet du kom med.
Katalogen
- GoogleNano BananaGoogles konverserande bildredigerare. Håller ett ansikte konsekvent mellan ändringar.
- Stability AIStable DiffusionDen öppna modellen som hela ekosystemet växte ur. LoRA, ControlNet, checkpoints.
- Black Forest LabsFLUX.1Byggd av före detta Stable Diffusion-forskare. Läser prompts bokstavligt, renderar text.
- Midjourney, Inc.MidjourneyDen med en tydlig husstil. Åsiktsstark, sluten, bara med abonnemang.
- RecraftRecraftDen som levererar riktiga vektorer. Byggd för varumärke och design.
- ByteDanceSeedreamByteDances modell. Stark tvåspråkig textrendering och hög upplösning direkt ur modellen.
- OpenAIgpt-image-1Modellen bakom ChatGPTs bilder. Följer instruktioner, återger text bra.
Så väljer du mellan dem
Frågan som avgör mest är om du skapar en bild eller ändrar en. Att skapa från inget belönar en modell med komposition och prompt-följsamhet; att ändra ett foto belönar en modell som låter allt du inte nämnde vara ifred. Det är nästan motsatta krav, och ett verktyg byggt för det ena är oftast mediokert på det andra.
Den andra frågan är om du behöver kunna återskapa resultatet. Stängda hostade modeller ändras under dig, och ett utseende du förlitar dig på kommersiellt kan sluta vara tillgängligt på en tidplan du inte styr. Öppna vikter löser det till priset av att du själv driver infrastrukturen.
Den tredje är utdataformat — och det är den som folk upptäcker för sent. Om filen måste öppnas i en vektorredigerare eller skrivas ut i två meters storlek, eliminerar det kravet det mesta av den här listan innan någon kvalitetsfråga ens uppstår.
Vad den här katalogen är
- Antal poster
- Sju modeller
- Rankade
- Nej — beskrivna
- Koppling
- Ingen med någon av dem
- Prissättning
- Medvetet inte listad
- Versioner
- Inte låsta — de ändras för snabbt
- Uppdaterad
- Augusti 2026
Så läser du en modelljämförelse
Nästan varje ranking svarar på en fråga du inte ställde
Listor över bästa bildmodellen byggs oftast genom att köra samma handfull prompts genom varje modell och bedöma resultaten. Det mäter hur varje modell hanterar just de prompts, vilket bara är användbart om ditt arbete liknar dem — och en testuppsättning vald för att se bra ut i en bloggpost gör sällan det.
Den mer användbara frågan är strukturell: skapar modellen bilder eller ändrar den dem, har den en estetisk uppfattning, kan du köra den själv, och vad kommer ut i andra änden — pixlar eller kurvor. De egenskaperna skiftar inte med nästa release och sorterar bort större delen av listan innan kvalitet ens diskuteras.

Tre frågor som snabbt snävar av fältet
Välj efter begränsning innan du väljer efter kvalitet
Första vägvalet, och det bredaste
Att generera en bild från en beskrivning och att redigera ett foto du redan har är närmast motsatta problem. Det ena belönar komposition och att följa prompten; det andra belönar att lämna orört det du inte nämnt.
Modeller byggda för redigering håller ett motivs identitet över successiva ändringar. Modeller byggda för generering ger dig kontroll över inramning, optik och stil från ingenting. Väldigt få är utmärkta på båda.
- Redigera ett befintligt foto: Nano Banana.
- Skapa från noll: FLUX, Midjourney.
- Båda, konversationellt: gpt-image-1.

Vem som styr det du är beroende av
Stängda, hostade modeller ändras under dig. Ett uttryck du byggt ett varumärke på kan sluta vara reproducerbart på en tidsplan du inte styr, och det finns ingen version att låsa.
Öppna vikter löser det men ger dig infrastrukturproblemet i utbyte — hårdvara, lagring, uppdateringar och en pipeline som går sönder när ett beroende rör sig.
- Reproducerbarhet är viktigt: Stable Diffusion, FLUX.
- Ingen aptit på infrastruktur: allt som är hostat.
- Volym och sekretess trycker mot egen drift.

Begränsningen folk upptäcker sist
Om resultatet måste öppnas i en vektorredigerare, skalas till en byggnad eller färgsättas om av någon annan nästa år, är en rasterbild fel artefakt hur bra den än ser ut.
På samma sätt, om bilden måste bära läsbar text i ett språk med tusentals tecken, så faller större delen av den här listan bort innan något annat övervägs.
- Redigerbara kurvor: Recraft.
- Kinesisk och engelsk text: Seedream.
- Annars: rasterpixlar.

Modellfrågor
Det folk frågar innan de väljer
Korta svar; det längre finns på varje modells egen sida.
Varför ger samma prompt och modell olika bilder?
För att startbruset skiljer sig. En seed låser det bruset, och prompt plus seed plus modell reproducerar en bild exakt. Ändra någon av de tre och du får något besläktat men inte identiskt.
Är en nyare modell alltid bättre?
På rå output, oftast. På allt runtomkring — community-verktyg, stiladaptrar, licensklarhet, prisstabilitet — ofta inte. Stable Diffusion är det tydligaste exemplet på en äldre modell som hålls vid liv av sitt ekosystem.
Kan jag flytta mina prompts mellan modeller?
Motivet och scenen överförs; parametrar och syntax gör det sällan. Modeller skiljer sig i hur de läser viktning, negativ och stiltoken, och en hårt trimmad prompt för en är oftast överspecificerad för en annan.
Vad ger öppna vikter mig egentligen?
Möjligheten att köra lokalt, låsa en version för alltid, generera utan kostnad per bild och hålla källmaterial borta från tredjepartsinfrastruktur. Det kostar dig hårdvaran och underhållet.
Vilken återger text ordentligt?
Flera hanterar korta strängar nu, och ingen ersätter riktigt textsättning. Generera bilden, lägg till orden i ett designverktyg, så undviker du hela problemkategorin.
Spelar modellen större roll än prompten?
Under en viss nivå av prompt, nej. En specifik prompt genom en mellanklassmodell slår en vag genom den bästa tillgängliga, vilket är varför promptguiden här är längre än den här katalogen.

Läs vidare
Vart du går härifrån
Fortsätt utforska
Annat på LaFoto
Katalogen beskriver verktygen; det här är vad du gör med dem.
- ändra till exakta pixlar
- konvertera ett bildformat
- bildkompressor
- beskär en bild
- hämta färger från en bild
- ta bort en bakgrund
- EXIF-visare
- AI-promptgenerator
- AI-generator för anime
- förvandla en bild till tecknad stil
- pixelkonstgenerator
- vilken generator du ska välja
- jämfört med Midjourney
- jämfört med Leonardo
- alternativ till Ideogram
- alternativ till Canva för bilder
- seed förklarat
- vad är denoise strength
- redigera innanför en mask
- LaFotos journal
Frågor om AI-bildmodeller
- Vilken AI-bildmodell är bäst?
- Det finns inget enda svar, vilket är varför det här registret beskriver i stället för att ranka. Midjourney lägger en estetik ovanpå, FLUX följer instruktioner bokstavligt, Nano Banana redigerar ett fotografi utan att tappa personen i det, Stable Diffusion ger dig byggsatserna, Recraft matar ut vektorer, Seedream sätter kinesisk och engelsk text, och gpt-image-1 tolkar en komplicerad mening. Välj efter vilken av dessa som beskriver ditt problem.
- Vad är skillnaden mellan en öppen och en sluten modell?
- Öppna vikter kan laddas ned och köras på din egen hårdvara, så du kan låsa en version permanent, generera utan kostnad per bild och hålla källmaterial borta från tredjepartsservrar. Slutna modeller nås via ett API eller en app, kräver ingen infrastruktur och ändras enligt leverantörens tidsplan snarare än din.
- Varför listar inte de här sidorna priser eller versionsnummer?
- För att båda ändras snabbare än en registersida hinner revideras, och ett inaktuellt tal läses som en lögn snarare än som stumhet. Det som står här är det som består — vem som gör den, hur du når den, om vikterna är öppna och vad den är byggd för att vara bra på.
- Är LaFoto knutet till någon av de här modellerna?
- Nej. Vi återförsäljer ingen av dem och har ingen kommersiell relation med deras tillverkare. Den enda plats vi talar i första person är FLUX-posten, där vi säger vilken modell som genererade sajtens egna bilder — ett påstående galleriet styrker kort för kort.
- Kan jag flytta en prompt från en modell till en annan?
- Motivet och scenen överförs; parametrarna och syntaxen gör det sällan. Modeller skiljer sig i hur de läser viktning, negativa och stiltokens, och en prompt som är hårt trimmad för en är oftast överspecificerad för en annan.
- Är en nyare modell alltid bättre än en äldre?
- På rå utgångskvalitet, oftast. På allt runtomkring — community-verktyg, stiladaptrar, licenstydlighet — ofta inte. Stable Diffusion är det tydligaste exemplet på en äldre modell som hålls relevant av sitt ekosystem snarare än av sina resultat.
- Vilken modell ska jag använda för att redigera ett foto jag redan har?
- En som är byggd för redigering snarare än generering. Den avgörande förmågan är att hålla ett motiv igenkännbart konstant över successiva ändringar, vilket de flesta text-till-bild-modeller tappar efter en eller två redigeringar.
- Återger någon av dem text pålitligt?
- Flera hanterar korta strängar tillräckligt bra för att designa runt, och ingen ersätter sättning. Generera bilden och lägg till orden i ett designverktyg — genererad text kan inte redigeras, stavningskontrolleras eller översättas i efterhand.
Börja skapa idag
Generera din första bild med den bästa AI-bildgeneratorn.
Gör en mening till en färdig, fotorealistisk bild på sekunder — och finslipa sedan varje detalj. Ingen setup, ingen Discord, inget GPU-krav.
Gå med bland 4 200+ kreatörer som använder LaFoto