Modellkatalog
AI-bildemodeller, beskrevet heller enn rangert
Sju modeller folk faktisk nevner, og hva hver av dem faktisk er til for. Ingen poengsummer, fordi svaret avhenger helt av jobben du kom med.
Katalogen
- GoogleNano BananaGoogles samtalebaserte bilderedigerer. Holder et ansikt konsistent gjennom endringer.
- Stability AIStable DiffusionDen åpne modellen hele økosystemet sprang ut fra. LoRA-er, ControlNet, checkpoints.
- Black Forest LabsFLUX.1Bygget av tidligere Stable Diffusion-forskere. Leser prompter bokstavelig, gjengir tekst.
- Midjourney, Inc.MidjourneyDen med en tydelig husstil. Egenrådig, lukket, kun med abonnement.
- RecraftRecraftDen som leverer ekte vektorer. Bygget for merkevare- og designarbeid.
- ByteDanceSeedreamByteDances modell. Sterk tospråklig tekstgjengivelse og høy oppløsning rett fra modellen.
- OpenAIgpt-image-1Modellen bak bildene i ChatGPT. Følger instruksjoner og gjengir tekst godt.
Slik velger du mellom dem
Spørsmålet som avgjør mest, er om du lager et bilde eller endrer ett. Å lage et bilde fra ingenting belønner en modell med komposisjon og prompt-etterlevelse; å endre et fotografi belønner en modell som lar alt du ikke nevnte være i fred. Det er nesten motsatte krav, og et verktøy bygget for det ene er som regel middelmådig på det andre.
Det andre spørsmålet er om du trenger at resultatet er reproduserbart. Lukkede, hostede modeller endrer seg i bakgrunnen, og et uttrykk du er kommersielt avhengig av kan slutte å være tilgjengelig på en tidsplan du ikke styrer. Åpne vekter løser det, mot at du må drive infrastrukturen selv.
Det tredje er utdataformat, og det er det folk ofte oppdager for sent. Hvis filen må åpnes i et vektorredigeringsprogram eller trykkes i to meter, utelukker det meste av denne listen før kvalitetsdiskusjonen i det hele tatt starter.
Hva denne katalogen er
- Oppføringer
- Sju modeller
- Rangert
- Nei — beskrevet
- Tilknytning
- Ingen til noen av dem
- Priser
- Bevisst ikke oppgitt
- Versjoner
- Ikke fastlåst — de endrer seg for raskt
- Oppdatert
- august 2026
Hvordan lese en modell-sammenligning
Nesten alle rangeringer svarer på et spørsmål du ikke stilte
Lister over den beste bildemodellen lages som regel ved å kjøre de samme håndfulle prompt gjennom hver modell og bedømme resultatene. Det måler hvordan hver modell håndterer akkurat disse promptene, som bare er nyttig hvis arbeidet ditt ligner på dem — og et testsett valgt for å se bra ut i en bloggpost, gjør sjelden det.
Det mer nyttige spørsmålet er strukturelt: lager denne modellen bilder eller endrer den dem, har den en estetisk preferanse, kan du kjøre den selv, og hva kommer ut i andre enden — piksler eller kurver. Disse egenskapene endrer seg ikke i neste slipp, og de eliminerer mesteparten av listen før kvalitet i det hele tatt diskuteres.

Tre spørsmål som snevrer inn feltet raskt
Velg etter begrensning før du velger etter kvalitet
Det første skillet, og det bredeste
Å generere et bilde fra en beskrivelse og å redigere et fotografi du allerede har, er nesten motsatte problemer. Det ene belønner komposisjon og prompt-etterlevelse; det andre belønner å la alt du ikke nevnte være urørt.
Modeller bygget for redigering holder på subjektets identitet gjennom påfølgende endringer. Modeller bygget for generering gir deg kontroll over innramming, optikk og stil fra ingenting. Svært få er utmerkede på begge.
- Redigere et eksisterende foto: Nano Banana.
- Lage ett fra ingenting: FLUX, Midjourney.
- Begge, samtalebasert: gpt-image-1.

Hvem som styrer det du er avhengig av
Lukkede, driftede modeller endrer seg under deg. Et uttrykk du bygget en merkevare på kan slutte å være reproduserbart på en tidsplan du ikke bestemmer, og det finnes ingen versjon å feste til.
Åpne vekter løser det og gir deg infrastrukturproblemet i bytte — maskinvare, lagring, oppdateringer og en pipeline som ryker når en avhengighet flytter seg.
- Reproduserbarhet er viktig: Stable Diffusion, FLUX.
- Ingen appetitt på infrastruktur: alt driftet.
- Volum og personvern trekker mot egen drift.

Begrensningen folk oppdager sist
Hvis resultatet må åpnes i et vektorverktøy, skaleres til en bygning, eller fargeendres av noen andre neste år, er et rasterbilde feil artefakt uansett hvor bra det ser ut.
Tilsvarende, hvis det må bære leselig skrift i et språk med tusenvis av tegn, eliminerer det mesteparten av denne listen før noe annet vurderes.
- Redigerbare kurver: Recraft.
- Kinesisk og engelsk skrift: Seedream.
- Alt annet: rasterpiksler.

Modellspørsmål
Det folk spør om før de velger
Korte svar, med den lange versjonen på hver modells egen side.
Hvorfor gir samme prompt og modell ulike bilder?
Fordi startstøyen er forskjellig. En seed låser den støyen, og prompt pluss seed pluss modell reproduserer et bilde nøyaktig. Endrer du én av de tre, får du noe beslektet, men ikke identisk.
Er en nyere modell alltid bedre?
På selve utdataene, som regel. På alt rundt — verktøykjede i miljøet, stiladaptere, lisensklarhet, prisstabilitet — ofte ikke. Stable Diffusion er det tydeligste eksempelet på en eldre modell holdt levende av økosystemet.
Kan jeg flytte promptene mine mellom modeller?
Motiv og scene overføres; parametere og syntaks gjør det sjelden. Modeller tolker vektlegging, negative og stil-tokens ulikt, og en hardt innstilt prompt for én er som regel overspesifisert for en annen.
Hva får jeg egentlig av åpne vekter?
Muligheten til å kjøre lokalt, feste en versjon for alltid, generere uten kostnad per bilde, og holde kildemateriale unna tredjeparts infrastruktur. Det koster deg maskinvare og vedlikehold.
Hvilken gjengir tekst skikkelig?
Flere håndterer korte strenger nå, og ingen erstatter typografi. Generer bildet, legg til teksten i et designverktøy, så unngår du hele problemkategorien.
Betyr modellen mer enn prompten?
Under en viss standard på prompt, nei. En spesifikk prompt gjennom en mellomklassemodell slår en vag gjennom den beste tilgjengelige, og derfor er prompt-veiledningen her lengre enn denne katalogen.

Les videre
Hvor du går videre fra katalogen
Utforsk videre
Andre steder på LaFoto
Katalogen beskriver verktøyene; dette er det du gjør med dem.
- endre til nøyaktig antall piksler
- konverter et bildeformat
- bildekompressor
- beskjær et bilde
- hent farger fra et bilde
- fjern en bakgrunn
- EXIF-viser
- AI prompt-generator
- anime AI-generator
- gjør et bilde om til tegneserie
- pikselkunst-generator
- hvilken generator du bør velge
- sammenlignet med Midjourney
- sammenlignet med Leonardo AI
- alternativ til Ideogram
- alternativ til Canva for bilder
- seed forklart
- hva er denoise strength
- redigering innenfor en maske
- LaFoto-journalen
Spørsmål om AI-bildemodeller
- Hvilken AI-bildemodell er best?
- Det finnes ikke ett svar, derfor beskriver denne katalogen i stedet for å rangere. Midjourney legger en estetikk, FLUX følger instruks bokstavelig, Nano Banana redigerer et fotografi uten å miste personen i det, Stable Diffusion gir deg byggeklossene, Recraft spytter ut vektorer, Seedream setter kinesisk og engelsk skrift, og gpt-image-1 tolker en komplisert setning. Velg etter hvilken av disse som beskriver problemet ditt.
- Hva er forskjellen på en åpen og en lukket modell?
- Åpne weights kan lastes ned og kjøres på din egen maskinvare, så du kan låse en versjon permanent, generere uten kost per bilde og holde kildemateriale unna tredjepartsservere. Lukkede modeller nås via et API eller en app, krever ingen infrastruktur, og endres etter leverandørens tidsplan, ikke din.
- Hvorfor lister ikke disse sidene priser eller versjonsnumre?
- Fordi begge deler endrer seg raskere enn en katalogside blir revidert, og et foreldet tall leses som en usannhet heller enn som foreldet. Det som står her, er delen som består — hvem som lager den, hvordan du får tak i den, om weights er åpne, og hva den er bygget for å være god på.
- Er LaFoto tilknyttet noen av disse modellene?
- Nei. Vi videreselger ingen av dem og har ingen kommersiell relasjon til opphavsmennene. Det ene stedet vi omtaler oss i første person er i FLUX-oppføringen, der vi sier hvilken modell som genererte nettstedets egne bilder — et krav galleriet underbygger kort for kort.
- Kan jeg flytte en prompt fra én modell til en annen?
- Motivet og scenen overføres; parametere og syntaks sjelden. Modeller skiller seg i hvordan de leser vekting, negative og stil-tokens, og en prompt hardt tunet for én er som regel overspesifisert for en annen.
- Er en nyere modell alltid bedre enn en eldre?
- På rå bildekvalitet, som oftest. På alt rundt — verktøy fra fellesskapet, stiladaptere, lisensklarhet — ofte ikke. Stable Diffusion er det tydeligste eksemplet på en eldre modell holdt relevant av økosystemet sitt snarere enn av resultatene.
- Hvilken modell bør jeg bruke for å redigere et foto jeg allerede har?
- En som er bygget for redigering heller enn generering. Skilleegenskapen er å holde et motiv gjenkjennelig konstant gjennom successive endringer, noe de fleste tekst-til-bilde-modeller mister etter én eller to redigeringer.
- Gjengir noen av dem tekst pålitelig?
- Flere håndterer korte strenger godt nok til å kunne designes rundt, og ingen erstatter typografi. Generer bildet og legg til ordene i et designverktøy — generert bokstavering kan ikke redigeres, stavekontrolleres eller oversettes i etterkant.
Start å skape i dag
Generer ditt første bilde med den beste AI-bildegeneratoren.
Gjør en setning om til et ferdig, fotorealistisk bilde på sekunder — og finpuss hver detalj. Ingen oppsett, ingen Discord, ingen GPU.
Bli med 4 200+ skapere som bruker LaFoto