Hoppa till innehåll
LaFoto

Modellkatalog

AI-bildmodeller, beskrivna snarare än rankade

Sju modeller som folk faktiskt nämner — och vad var och en faktiskt är till för. Inga poäng, för svaret beror helt på jobbet du kom med.

De här modellerna tävlar inte om samma sak. Midjourney lägger på en estetik, FLUX följer instruktioner bokstavligt, Nano Banana ändrar ett fotografi utan att tappa personen i det, Stable Diffusion ger dig byggdelarna, Recraft spottar ut redigerbara vektorer, Seedream sätter kinesisk och engelsk text, och gpt-image-1 tolkar en komplicerad mening. Välj utifrån vilken av de meningarna som beskriver ditt problem.

Så väljer du mellan dem

Frågan som avgör mest är om du skapar en bild eller ändrar en. Att skapa från inget belönar en modell med komposition och prompt-följsamhet; att ändra ett foto belönar en modell som låter allt du inte nämnde vara ifred. Det är nästan motsatta krav, och ett verktyg byggt för det ena är oftast mediokert på det andra.

Den andra frågan är om du behöver kunna återskapa resultatet. Stängda hostade modeller ändras under dig, och ett utseende du förlitar dig på kommersiellt kan sluta vara tillgängligt på en tidplan du inte styr. Öppna vikter löser det till priset av att du själv driver infrastrukturen.

Den tredje är utdataformat — och det är den som folk upptäcker för sent. Om filen måste öppnas i en vektorredigerare eller skrivas ut i två meters storlek, eliminerar det kravet det mesta av den här listan innan någon kvalitetsfråga ens uppstår.

Vad den här katalogen är

Antal poster
Sju modeller
Rankade
Nej — beskrivna
Koppling
Ingen med någon av dem
Prissättning
Medvetet inte listad
Versioner
Inte låsta — de ändras för snabbt
Uppdaterad
Augusti 2026

Så läser du en modelljämförelse

Nästan varje ranking svarar på en fråga du inte ställde

Listor över bästa bildmodellen byggs oftast genom att köra samma handfull prompts genom varje modell och bedöma resultaten. Det mäter hur varje modell hanterar just de prompts, vilket bara är användbart om ditt arbete liknar dem — och en testuppsättning vald för att se bra ut i en bloggpost gör sällan det.

Den mer användbara frågan är strukturell: skapar modellen bilder eller ändrar den dem, har den en estetisk uppfattning, kan du köra den själv, och vad kommer ut i andra änden — pixlar eller kurvor. De egenskaperna skiftar inte med nästa release och sorterar bort större delen av listan innan kvalitet ens diskuteras.

Sju små inramade fotoutskrifter ordnade i ett rutnät på en ljus studiovägg

Tre frågor som snabbt snävar av fältet

Välj efter begränsning innan du väljer efter kvalitet

Första vägvalet, och det bredaste

Att generera en bild från en beskrivning och att redigera ett foto du redan har är närmast motsatta problem. Det ena belönar komposition och att följa prompten; det andra belönar att lämna orört det du inte nämnt.

Modeller byggda för redigering håller ett motivs identitet över successiva ändringar. Modeller byggda för generering ger dig kontroll över inramning, optik och stil från ingenting. Väldigt få är utmärkta på båda.

  • Redigera ett befintligt foto: Nano Banana.
  • Skapa från noll: FLUX, Midjourney.
  • Båda, konversationellt: gpt-image-1.
En AI-redigerad produktscen med utbytt bakgrund

Modellfrågor

Det folk frågar innan de väljer

Korta svar; det längre finns på varje modells egen sida.

Varför ger samma prompt och modell olika bilder?

För att startbruset skiljer sig. En seed låser det bruset, och prompt plus seed plus modell reproducerar en bild exakt. Ändra någon av de tre och du får något besläktat men inte identiskt.

Är en nyare modell alltid bättre?

På rå output, oftast. På allt runtomkring — community-verktyg, stiladaptrar, licensklarhet, prisstabilitet — ofta inte. Stable Diffusion är det tydligaste exemplet på en äldre modell som hålls vid liv av sitt ekosystem.

Kan jag flytta mina prompts mellan modeller?

Motivet och scenen överförs; parametrar och syntax gör det sällan. Modeller skiljer sig i hur de läser viktning, negativ och stiltoken, och en hårt trimmad prompt för en är oftast överspecificerad för en annan.

Vad ger öppna vikter mig egentligen?

Möjligheten att köra lokalt, låsa en version för alltid, generera utan kostnad per bild och hålla källmaterial borta från tredjepartsinfrastruktur. Det kostar dig hårdvaran och underhållet.

Vilken återger text ordentligt?

Flera hanterar korta strängar nu, och ingen ersätter riktigt textsättning. Generera bilden, lägg till orden i ett designverktyg, så undviker du hela problemkategorin.

Spelar modellen större roll än prompten?

Under en viss nivå av prompt, nej. En specifik prompt genom en mellanklassmodell slår en vag genom den bästa tillgängliga, vilket är varför promptguiden här är längre än den här katalogen.

Ett AI-genererat matfotografi i dagsljus

Fortsätt utforska

Annat på LaFoto

Katalogen beskriver verktygen; det här är vad du gör med dem.

Frågor om AI-bildmodeller

Vilken AI-bildmodell är bäst?
Det finns inget enda svar, vilket är varför det här registret beskriver i stället för att ranka. Midjourney lägger en estetik ovanpå, FLUX följer instruktioner bokstavligt, Nano Banana redigerar ett fotografi utan att tappa personen i det, Stable Diffusion ger dig byggsatserna, Recraft matar ut vektorer, Seedream sätter kinesisk och engelsk text, och gpt-image-1 tolkar en komplicerad mening. Välj efter vilken av dessa som beskriver ditt problem.
Vad är skillnaden mellan en öppen och en sluten modell?
Öppna vikter kan laddas ned och köras på din egen hårdvara, så du kan låsa en version permanent, generera utan kostnad per bild och hålla källmaterial borta från tredjepartsservrar. Slutna modeller nås via ett API eller en app, kräver ingen infrastruktur och ändras enligt leverantörens tidsplan snarare än din.
Varför listar inte de här sidorna priser eller versionsnummer?
För att båda ändras snabbare än en registersida hinner revideras, och ett inaktuellt tal läses som en lögn snarare än som stumhet. Det som står här är det som består — vem som gör den, hur du når den, om vikterna är öppna och vad den är byggd för att vara bra på.
Är LaFoto knutet till någon av de här modellerna?
Nej. Vi återförsäljer ingen av dem och har ingen kommersiell relation med deras tillverkare. Den enda plats vi talar i första person är FLUX-posten, där vi säger vilken modell som genererade sajtens egna bilder — ett påstående galleriet styrker kort för kort.
Kan jag flytta en prompt från en modell till en annan?
Motivet och scenen överförs; parametrarna och syntaxen gör det sällan. Modeller skiljer sig i hur de läser viktning, negativa och stiltokens, och en prompt som är hårt trimmad för en är oftast överspecificerad för en annan.
Är en nyare modell alltid bättre än en äldre?
På rå utgångskvalitet, oftast. På allt runtomkring — community-verktyg, stiladaptrar, licenstydlighet — ofta inte. Stable Diffusion är det tydligaste exemplet på en äldre modell som hålls relevant av sitt ekosystem snarare än av sina resultat.
Vilken modell ska jag använda för att redigera ett foto jag redan har?
En som är byggd för redigering snarare än generering. Den avgörande förmågan är att hålla ett motiv igenkännbart konstant över successiva ändringar, vilket de flesta text-till-bild-modeller tappar efter en eller två redigeringar.
Återger någon av dem text pålitligt?
Flera hanterar korta strängar tillräckligt bra för att designa runt, och ingen ersätter sättning. Generera bilden och lägg till orden i ett designverktyg — genererad text kan inte redigeras, stavningskontrolleras eller översättas i efterhand.

Börja skapa idag

Generera din första bild med den bästa AI-bildgeneratorn.

Gör en mening till en färdig, fotorealistisk bild på sekunder — och finslipa sedan varje detalj. Ingen setup, ingen Discord, inget GPU-krav.

Gå med bland 4 200+ kreatörer som använder LaFoto