Ugrás a tartalomra
LaFoto

Black Forest Labs · model directory

Mi a FLUX.1? A jelenlegi képminőség nagy részének hátterében álló modell

A FLUX.1 a Black Forest Labs képmodell-családja; a céget egykori Stable Diffusion-kutatók alapították. A variánsok, és miért követi szorosan a promptokat.

A FLUX.1 a Black Forest Labs szövegből képet készítő modellcsaládja; a céget olyan kutatók alapították, akik a Stable Diffusionön dolgoztak. Arról ismert, hogy a korábbi nyílt modelleknél szorosabban, szó szerint követi a promptokat, és olvasható szöveget renderel a képeken. Több variánsban érkezik, amelyek sebességben, licencfeltételekben és minőségben különböznek egymástól.

FLUX.1 at a glance

Készítő
Black Forest Labs
Származás
Volt Stable Diffusion-kutatók
Változatok
gyors, dev, pro
Erről ismert
Promptkövetés, olvasható szöveg
Súlyok
Nyíltak néhány variánsnál
Itt erre használjuk
Az oldal saját képeihez

A változatok, és miért számít ez már indulás előtt

A FLUX nem egyetlen modell. A család egy gyors, desztillált variánsra bomlik, amely nagyon kevés lépésben ad használható képet; egy középső variánsra, amely nyíltan letölthető, de a kereskedelmi felhasználást korlátozó licenccel; és egy csúcsvariánsra, amely API-n keresztül érhető el fájl helyett.

A lényeges következmény jogi, nem technikai. A nyíltan letölthető variánst választani a kényelem miatt, majd a kimenetét kereskedelmi célra használni — ez a leggyakrabban elkövetett hiba, és arról a licenc dönt, nem a modell, hogy ez megengedett-e.

Ellenőrizze, egy hosztolt szolgáltatás pontosan melyik variánst futtatja, mielőtt feltételezné, mit tehet a kimenettel. Nem mindig közlik, és a válasz megváltoztatja, mi az, ami az Öné.

Miért követi szorosabban a promptot

A gyakorlatban az a tapasztalat, hogy kevesebbet „vitatkozik”. Ha három konkrét tárgyat kér meghatározott elrendezésben, nagyobb eséllyel kap három tárgyat pont úgy elrendezve, nem pedig egy szép képet kettővel és máshogy.

Ennek valós ára van. Egy modell, amely szorosan ragaszkodik az utasításokhoz, kevésbé hajlamos feljavítani a középszerű promptot, így a homályos kérés homályos képet ad, nem pedig „megszépített” eredményt. Az erősebb esztétikai véleményű modellek hízelegnek a lusta promptoknak, és ellenállnak a szigorú specifikációnak; ez ennek az ellentéte.

A gyakorlati következmény, hogy itt a részletek arányosan megtérülnek. A fény megnevezése, a fókusztávolság és a médium kimondottan érezhetően változtat az eredményen — ezért írjuk a prompt útmutatókat ezen az oldalon ilyen részletességgel.

Szöveg a képeken — ami régen biztos lebuktató volt

Az olvasható felirat évekig megbízható jele volt a generált képnek. A táblák felirata „hihető maszlagként” jött ki, mert a diffusion modell vizuális statisztikákból rakta össze a betűformákat, nem pedig szó szerint betűzött.

A FLUX ebben érezhetően jobb, és rövid szövegek — egy szó egy táblán, egy címke egy csomagoláson, egy plakát címe — elég gyakran olvashatók ahhoz, hogy lehessen rájuk tervezni. Ez nem tördelőmotor: a hosszú szövegek továbbra is romlanak, és minél hosszabb a string, annál rosszabbak az esélyek.

A praktikus módszer, hogy kevesebb szöveget kér, mint amennyit szeretne, és a többit utólag, rendes tervezőeszközben adja hozzá. Egy generált háttér egy olvasható szóval, majd rendes eszközben befejezve, jobb, mint egy generált kép egy beégetett, csaknem-jó bekezdéssel.

Hova illeszkedik a könyvtár többi eleméhez képest

A Stable Diffusionhöz képest újabb munka részben ugyanattól a csapattól: általában erősebb kimenet és jobb utasításkövetés, szemben a közösségi checkpointok és stílusadapterek jóval szűkebb készletével.

A Midjourney-hez mérve visszafogottabb. A Midjourney rövid promptból is markáns nézőpontú képet készít; a FLUX azt készíti el, amit kért — ez jobb, ha pontosan tudja, mit akar, és rosszabb, ha meglepetést remél.

A zárt, asszisztenshez kötött modellekhez képest ez az, amit ténylegesen futtathat vagy hosztolhat, ami számít, ha az áteresztőképesség, az adatvédelem vagy a reprodukálhatóság nem preferencia, hanem követelmény.

Mire használja a LaFoto

Az oldalon látható fényképek a FLUX családdal készülnek — a galériában minden kártyán feltüntetjük a modellt a prompttal és a seeddel együtt, így az állítás ellenőrizhető, nem csak kijelentett. Nincs kereskedelmi kapcsolatunk a Black Forest Labs-szal; eszköz, amelyért úgy fizetünk, mint bárki más.

Azért írjuk ki, melyik modell készített egy képet, mert egy oldal, amely a prompt-készség mellett érvel, de a példaképei eredetét nem közli, saját magát gyengíti. Ha a galériában lévő promtok valósak, lefuttathatók, és a modell neve a lefuttathatóság része.

Utasítás az esztétika előtt

Egy modell, amely kevésbé vitatkozik Önnel

Akik áttérnek rá, következetesen azt mondják: azt csinálja, amit mondanak neki. Három megnevezett tárgy egy leírt elrendezésben valóban három tárgyként jön vissza abban az elrendezésben — nem egy tetszetős kép két tárggyal benne.

Ez csere, nem ingyenes nyereség. Egy modell, amely szorosan követi az utasítást, nem fogja megmenteni a lusta promptot, így a homályos bemenet homályos kimenetet ad ahelyett, hogy valami látványossá hízelegné magát.

Fotónyomat egy gépelt felvételi lista mellett világos stúdióasztalon

Három variáns, három csere

Melyik FLUX fut egy szolgáltatásban — és ez mit enged meg

Desztillált a sebességért

Kevés lépésben ad használható képet, ezért praktikus előnézethez, iterációhoz és nagy tömegű generáláshoz.

A csúcsminőség alacsonyabb a nagyobb variánsoknál, és a különbség a finom textúrákon és összetett jeleneteken a leglátványosabb.

  • Legkevesebb lépés, legalacsonyabb késleltetés.
  • Jó prompt iterálásához.
  • A család legengedékenyebb licence.
AI által generált termék csendélet

FLUX kérdések

Ami felmerül, amikor erre váltanak

A gyakorlati különbségek ahhoz képest, amit a legtöbben korábban használtak.

Miért működnek rosszabbul a régi promptjaim?

Az erős esztétikájú modellekre hangolt promptok tele vannak minőségi tokenekkel és stíluszavakkal, amelyek elvégezték a modell munkáját. Itt ez a töltelék versenyez a tényleges leírással.

Mit tartalmazzon inkább egy prompt?

Először a téma, aztán a médium, majd a fény, végül az optika. Konkrét főnevek és fotótechnikai kifejezések mozgatják a kimenetet; az olyan jelzők, mint álomszerű vagy epikus, nem rendelkeznek következetes vizuális jelentéssel.

Tényleg tud szöveget renderelni?

Rövid karaktersorokat, gyakran elég jól ahhoz, hogy köré lehessen tervezni. Hosszabb szövegek még romlanak, és egy képi modell nem helyettesíti a rendes tördelést utólag.

Kell hozzá negatív prompt?

Sok FLUX végpontnak egyáltalán nincs negatív csatornája, vagyis mindent, amit ír, pozitív utasításként értelmez. Ha ilyen végpontba azt írja, „no text”, azzal szöveget kér.

Van hozzá LoRA ökoszisztéma?

Egyre bővül, de még messze kisebb annál a készletnél, ami több év alatt a Stable Diffusion köré épült. Ha egy konkrét közösségi stílustól függ, váltás előtt ellenőrizze.

Melyik variáns készítette az itteni képeket?

A galéria minden kártyán feltünteti a modellt a prompt és a seed mellett, így ellenőrizhető, nem csak állítás.

MI által generált élelmiszerfotó nappali fényben

Fedezze fel tovább

Máshol a LaFoto oldalán

Az itteni oldalak ennek a modellnek a képeivel illusztráltak.

FLUX.1 — questions people ask

Mi a FLUX.1?
Szövegből képet készítő modellcsalád a Black Forest Labs-tól; a céget a Stable Diffusionön korábban dolgozó kutatók alapították.
Ki készítette a FLUX-ot?
A Black Forest Labs. Az alapítók a Stable Diffusion csapatából jöttek.
Ingyen használható a FLUX?
A variánstól függ. Némelyik nyíltan letölthető, mások csak API-n érhetők el, és a nyíltan letölthetők sem mind engednek kereskedelmi felhasználást. Az adott variáns licence az irányadó.
Mi a különbség a FLUX schnell, dev és pro között?
Röviden: a schnell kevés lépésre desztillált, gyors variáns; a dev a nyíltan letölthető, középső opció licencfeltételekkel; a pro a legjobb minőségű, API-n elérhető variáns fájl helyett.
Jobb a FLUX, mint a Stable Diffusion?
Kimeneti minőségben és promptkövetésben általában igen. A közösségi checkpointok, stílusadapterek és vezérlő eszközök bőségében nem — az ökoszisztéma a Stable Diffusion körül sokkal nagyobb.
Tud a FLUX olvasható szöveget generálni a képekre?
Rövid szövegeket gyakran. Érezhetően jobb ebben, mint a korábbi diffusion modellek, de a hosszú szövegek továbbra is romlanak, és nem helyettesíti a rendes tördelést.
Használja a LaFoto a FLUX-ot?
Igen, az oldal képeinél. A galéria minden kártyája jelzi a használt modellt, promptot és seedet.
Miért „nem reagál” a FLUX a homályos promptokra?
Szorosan követi az utasításokat ahelyett, hogy saját esztétikát erőltetne, így a homályos prompt homályos képet ad, nem „megszépített” eredményt. A konkrét promptokat arányosan jutalmazza.

Kezdjen alkotni még ma

Generálja le első képét a legjobb AI képgenerátorral.

Egy mondatból másodpercek alatt kész, fotórealisztikus kép — majd finomítsa a részleteket. Nincs setup, nincs Discord, nincs GPU.

Csatlakozzon 4200+ alkotóhoz, akik a LaFotót használják