Hoppa till innehåll
LaFoto

Black Forest Labs · model directory

Vad är FLUX.1? Modellen bakom mycket av dagens bildkvalitet

FLUX.1 är en modellfamilj för bilder från Black Forest Labs, grundat av tidigare Stable Diffusion-forskare. Dess varianter, och varför den följer prompts noggrant.

FLUX.1 är en familj av text-till-bild-modeller från Black Forest Labs, ett bolag grundat av forskare som arbetade med Stable Diffusion. Den är känd för att följa prompts mer bokstavligt än tidigare öppna modeller och för att rendera läsbar text i bilder, och den levereras i flera varianter som byter hastighet, licensvillkor och kvalitet mot varandra.

FLUX.1 at a glance

Utvecklare
Black Forest Labs
Härkomst
Före detta Stable Diffusion-forskare
Varianter
snabb, dev, pro
Känd för
Prompt-följsamhet, läsbar text
Vikter
Öppna för vissa varianter
Använd här för
Den här sajtens egna bilder

Varianterna, och varför skillnaden spelar roll innan du börjar

FLUX är inte en modell. Familjen delas i en snabb destillerad variant byggd för att ge en användbar bild på väldigt få steg, en mellanvariant som är öppet nedladdningsbar men med licensvillkor som begränsar kommersiell användning, och en toppvariant tillgänglig via API i stället för som fil.

Den viktiga konsekvensen är juridisk snarare än teknisk. Att välja den öppet nedladdningsbara varianten för att den är bekväm, och sedan använda dess utdata kommersiellt, är misstaget som görs oftast — och det är licensen, inte modellen, som avgör om det är tillåtet.

Kontrollera vilken variant en hostad tjänst faktiskt kör innan du antar vad du får göra med resultatet. Tjänster säger inte alltid, och svaret ändrar vad du äger.

Varför den följer en prompt närmare

Den praktiska erfarenhet folk rapporterar är att den argumenterar mindre. Ber du om tre specifika objekt arrangerade på ett visst sätt får du mer sannolikt tre objekt arrangerade så, i stället för en vacker bild med två av dem och en annan komposition.

Det byter mot något verkligt. En modell som lyder instruktioner tätt är mindre benägen att förbättra en medioker prompt, så en vag begäran ger en vag bild i stället för att smickras till något slående. Modeller med starkare estetisk åsikt smickrar lata prompts och kämpar mot specifika; detta är andra änden av det bytet.

Den praktiska implikationen är att detaljrikedom belönas här på ett sätt som inte gäller överallt. Att namnge ljuset, brännvidden och mediet ändrar utfallet påtagligt, vilket är varför prompt-guiden på den här sajten är skriven i de termerna.

Text i bilder, som förr var avslöjandet

Läsbara bokstäver var i åratal det säkra sättet att avslöja en genererad bild. Skyltar kom ut som trovärdig rappakalja eftersom en diffusion-modell satte ihop bokstavsformer av visuella statistiker i stället för att stava något.

FLUX är avsevärt bättre på detta, och korta strängar — ett ord på en skylt, en etikett på en förpackning, en titel på en affisch — blir läsbara tillräckligt ofta för att gå att designa runt. Det är inte en sättningsmotor: längre stycken faller fortfarande isär, och ju längre strängen är desto sämre odds.

Den praktiska tekniken är att be om mindre text än du vill ha och lägga till resten ordentligt efteråt. En genererad bakgrund med ett läsbart ord på, färdigställd i ett riktigt designverktyg, slår en genererad bild med ett stycke nästan-rätt text inbränt i pixlarna.

Var den passar i katalogen i övrigt

Jämfört med Stable Diffusion är det nyare arbete av överlappande personer: generellt starkare output och bättre instruktion-följande, mot ett mycket mindre lager av community-checkpoints och stiladaptrar.

Jämfört med Midjourney är den mindre opinionerad. Midjourney gör något med en tydlig hållning från en kort prompt; FLUX gör det du bad om, vilket är bättre när du vet exakt vad du vill ha och sämre när du hoppas bli överraskad.

Jämfört med de stängda assistentkopplade modellerna är det den du faktiskt kan köra eller hosta själv, vilket spelar roll när kapacitet, integritet eller reproducerbarhet är begränsningar snarare än preferenser.

Vad LaFoto använder den till

Fotografierna på den här sajten genereras med FLUX-familjen — galleriet anger modellen på varje kort tillsammans med prompt och seed, så påståendet är möjligt att kontrollera i stället för att bara hävdas. Vi har ingen kommersiell relation med Black Forest Labs; det är ett verktyg vi betalar för som alla andra.

Anledningen att vi anger vilken modell som gjort en bild är att en sajt som argumenterar för prompt-hantverk men illustrerar det med bilder vars proveniens den inte avslöjar, har underminerat sin egen tes. Om promptarna på gallerisidan är verkliga kan de köras, och ett modellnamn är en del av att kunna köra dem.

Instruktion före estetik

En modell som bråkar mindre med dig

Den återkommande rapporten från folk som byter till den är att den gör som den blir tillsagd. Tre namngivna objekt i en beskriven uppställning kommer tillbaka som tre objekt i den uppställningen — inte som en snygg bild som innehåller två av dem.

Det är en avvägning, inte en gratisslant. En modell som följer instruktioner noga räddar inte en slapp prompt, så vag indata ger vag utdata istället för att smickras till något slående.

En fotoutskrift bredvid en maskinskriven shotlist på ett ljust studiobord

Tre varianter, tre avvägningar

Vilken FLUX en tjänst kör avgör vad du får göra

Destillerad för fart

Byggd för att ge en användbar bild på mycket få steg, vilket gör den praktisk för förhandsvisningar, iteration och allt som genererar i volym.

Kvaliteten är lägre än hos de större varianterna i toppänden, och gapet syns mest i fin textur och komplexa scener.

  • Färst steg, lägst latens.
  • Bra för att iterera på en prompt.
  • Den mest tillåtande licensen i familjen.
Ett AI-genererat produktstilleben

FLUX-frågor

Vad som dyker upp när folk byter till den

De praktiska skillnaderna mot det de flesta använde tidigare.

Varför funkar mina gamla prompts sämre?

Prompts trimmade för en modell med stark estetik är oftast uppstoppade med kvalitetsord och stilord som gjorde modellens jobb åt den. Här konkurrerar den stoppningen med själva beskrivningen.

Vad ska en prompt innehålla istället?

Motiv, sedan medium, sedan ljus, sedan optik. Konkreta substantiv och fotografiska termer flyttar utgången; adjektiv som drömsk eller episk har ingen konsekvent visuell betydelse att verka på.

Kan den verkligen återge text?

Korta strängar, ofta tillräckligt bra för att designa runt. Längre stycken bryts fortfarande ned, och ingen bildmodell ersätter att sätta typografin ordentligt i efterhand.

Behöver den en negativ prompt?

Många FLUX-ändpunkter har ingen negativ kanal alls, vilket betyder att allt du skriver är en positiv instruktion. Att skriva "no text" i en sådan ändpunkt ber om text.

Finns det ett LoRA-ekosystem för den?

Ett växande, och långt mindre än inventoryn som byggts kring Stable Diffusion över flera år. Om du är beroende av en specifik community-stil, kontrollera innan du byter.

Vilken variant gjorde bilderna på den här sajten?

Galleriet anger modellen på varje kort, sida vid sida med prompt och seed, så det går att kontrollera istället för att bara påstås.

Ett AI-genererat matfotografi i dagsljus

Fortsätt utforska

På andra ställen på LaFoto

Sidorna här illustreras med den här modellen.

FLUX.1 — questions people ask

Vad är FLUX.1?
En familj av text-till-bild-modeller från Black Forest Labs, ett bolag grundat av forskare som tidigare arbetade med Stable Diffusion.
Vem gjorde FLUX?
Black Forest Labs. Grundarna kom från teamet bakom Stable Diffusion.
Är FLUX gratis att använda?
Det beror på varianten. Vissa är öppet nedladdningsbara och vissa är endast via API, och de öppet nedladdningsbara tillåter inte alla kommersiell användning. Licensen för just den varianten styr.
Vad är skillnaden mellan FLUX schnell, dev och pro?
I grova drag: schnell är destillerad för hastighet på väldigt få steg, dev är det öppet nedladdningsbara mellanläget med licensvillkor, och pro är den högsta kvalitetsvarianten som erbjuds via API i stället för som fil.
Är FLUX bättre än Stable Diffusion?
På output-kvalitet och prompt-följsamhet, generellt ja. På bredden av community-checkpoints, stiladaptrar och kontrollverktyg som finns, nej — det ekosystemet är mycket större runt Stable Diffusion.
Kan FLUX generera läsbar text i bilder?
Korta strängar, ofta. Den är påtagligt bättre än tidigare diffusion-modeller på detta, men långa passager faller fortfarande isär och den ersätter inte riktig textsättning.
Använder LaFoto FLUX?
Ja, för bilderna på den här sajten. Varje kort i galleriet listar modellen, prompt och seed som användes.
Varför verkar FLUX ignorera vaga prompts?
Den följer instruktioner nära i stället för att påtvinga en egen estetik, så en vag prompt ger en vag bild i stället för att smickras till något slående. Specifika prompts belönas proportionellt.

Börja skapa idag

Generera din första bild med den bästa AI-bildgeneratorn.

Gör en mening till en färdig, fotorealistisk bild på sekunder — och finslipa sedan varje detalj. Ingen setup, ingen Discord, inget GPU-krav.

Gå med bland 4 200+ kreatörer som använder LaFoto