Hopp til innhold
LaFoto

Modellkatalog

AI-bildemodeller, beskrevet heller enn rangert

Sju modeller folk faktisk nevner, og hva hver av dem faktisk er til for. Ingen poengsummer, fordi svaret avhenger helt av jobben du kom med.

Disse modellene konkurrerer ikke om det samme. Midjourney påtvinger en estetikk, FLUX følger instruksjoner ordrett, Nano Banana endrer et fotografi uten å miste personen i det, Stable Diffusion gir deg delene, Recraft leverer redigerbare vektorer, Seedream setter kinesisk og engelsk typografi, og gpt-image-1 tolker en komplisert setning. Velg ut fra hvilken av disse setningene som beskriver problemet ditt.

Slik velger du mellom dem

Spørsmålet som avgjør mest, er om du lager et bilde eller endrer ett. Å lage et bilde fra ingenting belønner en modell med komposisjon og prompt-etterlevelse; å endre et fotografi belønner en modell som lar alt du ikke nevnte være i fred. Det er nesten motsatte krav, og et verktøy bygget for det ene er som regel middelmådig på det andre.

Det andre spørsmålet er om du trenger at resultatet er reproduserbart. Lukkede, hostede modeller endrer seg i bakgrunnen, og et uttrykk du er kommersielt avhengig av kan slutte å være tilgjengelig på en tidsplan du ikke styrer. Åpne vekter løser det, mot at du må drive infrastrukturen selv.

Det tredje er utdataformat, og det er det folk ofte oppdager for sent. Hvis filen må åpnes i et vektorredigeringsprogram eller trykkes i to meter, utelukker det meste av denne listen før kvalitetsdiskusjonen i det hele tatt starter.

Hva denne katalogen er

Oppføringer
Sju modeller
Rangert
Nei — beskrevet
Tilknytning
Ingen til noen av dem
Priser
Bevisst ikke oppgitt
Versjoner
Ikke fastlåst — de endrer seg for raskt
Oppdatert
august 2026

Hvordan lese en modell-sammenligning

Nesten alle rangeringer svarer på et spørsmål du ikke stilte

Lister over den beste bildemodellen lages som regel ved å kjøre de samme håndfulle prompt gjennom hver modell og bedømme resultatene. Det måler hvordan hver modell håndterer akkurat disse promptene, som bare er nyttig hvis arbeidet ditt ligner på dem — og et testsett valgt for å se bra ut i en bloggpost, gjør sjelden det.

Det mer nyttige spørsmålet er strukturelt: lager denne modellen bilder eller endrer den dem, har den en estetisk preferanse, kan du kjøre den selv, og hva kommer ut i andre enden — piksler eller kurver. Disse egenskapene endrer seg ikke i neste slipp, og de eliminerer mesteparten av listen før kvalitet i det hele tatt diskuteres.

Syv små innrammede fotografiske trykk arrangert i et rutenett på en lys studiovegg

Tre spørsmål som snevrer inn feltet raskt

Velg etter begrensning før du velger etter kvalitet

Det første skillet, og det bredeste

Å generere et bilde fra en beskrivelse og å redigere et fotografi du allerede har, er nesten motsatte problemer. Det ene belønner komposisjon og prompt-etterlevelse; det andre belønner å la alt du ikke nevnte være urørt.

Modeller bygget for redigering holder på subjektets identitet gjennom påfølgende endringer. Modeller bygget for generering gir deg kontroll over innramming, optikk og stil fra ingenting. Svært få er utmerkede på begge.

  • Redigere et eksisterende foto: Nano Banana.
  • Lage ett fra ingenting: FLUX, Midjourney.
  • Begge, samtalebasert: gpt-image-1.
AI-redigert produktscene med byttet bakgrunn

Modellspørsmål

Det folk spør om før de velger

Korte svar, med den lange versjonen på hver modells egen side.

Hvorfor gir samme prompt og modell ulike bilder?

Fordi startstøyen er forskjellig. En seed låser den støyen, og prompt pluss seed pluss modell reproduserer et bilde nøyaktig. Endrer du én av de tre, får du noe beslektet, men ikke identisk.

Er en nyere modell alltid bedre?

På selve utdataene, som regel. På alt rundt — verktøykjede i miljøet, stiladaptere, lisensklarhet, prisstabilitet — ofte ikke. Stable Diffusion er det tydeligste eksempelet på en eldre modell holdt levende av økosystemet.

Kan jeg flytte promptene mine mellom modeller?

Motiv og scene overføres; parametere og syntaks gjør det sjelden. Modeller tolker vektlegging, negative og stil-tokens ulikt, og en hardt innstilt prompt for én er som regel overspesifisert for en annen.

Hva får jeg egentlig av åpne vekter?

Muligheten til å kjøre lokalt, feste en versjon for alltid, generere uten kostnad per bilde, og holde kildemateriale unna tredjeparts infrastruktur. Det koster deg maskinvare og vedlikehold.

Hvilken gjengir tekst skikkelig?

Flere håndterer korte strenger nå, og ingen erstatter typografi. Generer bildet, legg til teksten i et designverktøy, så unngår du hele problemkategorien.

Betyr modellen mer enn prompten?

Under en viss standard på prompt, nei. En spesifikk prompt gjennom en mellomklassemodell slår en vag gjennom den beste tilgjengelige, og derfor er prompt-veiledningen her lengre enn denne katalogen.

Et AI-generert matfoto i dagslys

Utforsk videre

Andre steder på LaFoto

Katalogen beskriver verktøyene; dette er det du gjør med dem.

Spørsmål om AI-bildemodeller

Hvilken AI-bildemodell er best?
Det finnes ikke ett svar, derfor beskriver denne katalogen i stedet for å rangere. Midjourney legger en estetikk, FLUX følger instruks bokstavelig, Nano Banana redigerer et fotografi uten å miste personen i det, Stable Diffusion gir deg byggeklossene, Recraft spytter ut vektorer, Seedream setter kinesisk og engelsk skrift, og gpt-image-1 tolker en komplisert setning. Velg etter hvilken av disse som beskriver problemet ditt.
Hva er forskjellen på en åpen og en lukket modell?
Åpne weights kan lastes ned og kjøres på din egen maskinvare, så du kan låse en versjon permanent, generere uten kost per bilde og holde kildemateriale unna tredjepartsservere. Lukkede modeller nås via et API eller en app, krever ingen infrastruktur, og endres etter leverandørens tidsplan, ikke din.
Hvorfor lister ikke disse sidene priser eller versjonsnumre?
Fordi begge deler endrer seg raskere enn en katalogside blir revidert, og et foreldet tall leses som en usannhet heller enn som foreldet. Det som står her, er delen som består — hvem som lager den, hvordan du får tak i den, om weights er åpne, og hva den er bygget for å være god på.
Er LaFoto tilknyttet noen av disse modellene?
Nei. Vi videreselger ingen av dem og har ingen kommersiell relasjon til opphavsmennene. Det ene stedet vi omtaler oss i første person er i FLUX-oppføringen, der vi sier hvilken modell som genererte nettstedets egne bilder — et krav galleriet underbygger kort for kort.
Kan jeg flytte en prompt fra én modell til en annen?
Motivet og scenen overføres; parametere og syntaks sjelden. Modeller skiller seg i hvordan de leser vekting, negative og stil-tokens, og en prompt hardt tunet for én er som regel overspesifisert for en annen.
Er en nyere modell alltid bedre enn en eldre?
På rå bildekvalitet, som oftest. På alt rundt — verktøy fra fellesskapet, stiladaptere, lisensklarhet — ofte ikke. Stable Diffusion er det tydeligste eksemplet på en eldre modell holdt relevant av økosystemet sitt snarere enn av resultatene.
Hvilken modell bør jeg bruke for å redigere et foto jeg allerede har?
En som er bygget for redigering heller enn generering. Skilleegenskapen er å holde et motiv gjenkjennelig konstant gjennom successive endringer, noe de fleste tekst-til-bilde-modeller mister etter én eller to redigeringer.
Gjengir noen av dem tekst pålitelig?
Flere håndterer korte strenger godt nok til å kunne designes rundt, og ingen erstatter typografi. Generer bildet og legg til ordene i et designverktøy — generert bokstavering kan ikke redigeres, stavekontrolleres eller oversettes i etterkant.

Start å skape i dag

Generer ditt første bilde med den beste AI-bildegeneratoren.

Gjør en setning om til et ferdig, fotorealistisk bilde på sekunder — og finpuss hver detalj. Ingen oppsett, ingen Discord, ingen GPU.

Bli med 4 200+ skapere som bruker LaFoto