Przejdź do treści
LaFoto

Black Forest Labs · model directory

Czym jest FLUX.1? Model stojący za sporą częścią obecnej jakości obrazów

FLUX.1 to rodzina modeli obrazów od Black Forest Labs, założonego przez byłych badaczy Stable Diffusion. Jej warianty i dlaczego tak wiernie podąża za promptem.

FLUX.1 to rodzina modeli text-to-image od Black Forest Labs, firmy założonej przez badaczy, którzy pracowali nad Stable Diffusion. Słynie z bardziej dosłownego podążania za promptami niż wcześniejsze modele otwarte oraz z renderowania czytelnego tekstu w obrazach. Występuje w kilku wariantach, które inaczej rozkładają kompromis między szybkością, warunkami licencji i jakością.

FLUX.1 at a glance

Twórca
Black Forest Labs
Pochodzenie
Byli badacze Stable Diffusion
Warianty
szybki, dev, pro
Znany z
Wierność promptom, czytelny tekst
Wagi
Otwarte dla części wariantów
Wykorzystywany tu do
Obrazów na tej stronie

Warianty i dlaczego to ważne, zanim Państwo zaczną

FLUX to nie jest jeden model. Rodzina dzieli się na szybki wariant destylowany, projektowany do uzyskania użytecznego obrazu w bardzo małej liczbie kroków, wariant „środkowy”, który można pobrać, ale z licencją ograniczającą użycie komercyjne, oraz najwyższy wariant dostępny przez API, a nie jako plik.

Najistotniejsza konsekwencja jest prawna, nie techniczna. Wybranie wariantu do pobrania, bo jest wygodny, a potem komercyjne użycie jego wyników to najczęstszy błąd — i to licencja, a nie model, rozstrzyga, czy jest to dozwolone.

Proszę sprawdzić, który wariant dana usługa hostowana faktycznie uruchamia, zanim założą Państwo, co wolno z wynikiem. Usługi nie zawsze to deklarują, a odpowiedź zmienia zakres Państwa praw.

Dlaczego wierniej podąża za promptem

Doświadczenie z praktyki jest takie, że mniej „dyskutuje”. Poproszą Państwo o trzy konkretne obiekty ułożone w określony sposób i częściej otrzymają trzy obiekty ułożone właśnie tak, zamiast pięknego obrazu z dwoma z nich i inną kompozycją.

To ma realny koszt. Model, który ściśle trzyma się instrukcji, jest mniej skłonny „poprawiać” przeciętny prompt, więc nieprecyzyjna prośba zwraca nieprecyzyjny obraz, a nie efektowny. Modele o silniejszej opinii estetycznej „schlebiają” leniwym promptom i walczą ze sprecyzowanymi — tu jest drugi koniec tego kompromisu.

Wniosek roboczy: szczegółowość jest tu nagradzana w sposób, w jaki nie wszędzie bywa. Nazwanie światła, ogniskowej i medium wyraźnie zmienia wynik, dlatego wskazówki promptowe na tej stronie są pisane właśnie w tych kategoriach.

Tekst w obrazach, który kiedyś zdradzał generację

Czytelne liternictwo było przez lata pewnym sposobem rozpoznania obrazu generowanego. Szyldy wychodziły jako wiarygodny bełkot, bo model diffusion składał kształty liter ze statystyk wizualnych, a nie „spisywał” czegokolwiek.

FLUX jest w tym wyraźnie lepszy i krótkie ciągi — słowo na szyldzie, etykieta na opakowaniu, tytuł plakatu — bywają czytelne na tyle często, by można było na tym projektowo polegać. To nie jest jednak silnik składu: długie fragmenty nadal się degradują i im dłuższy tekst, tym gorsze szanse.

Praktyczna technika: prosić o mniej tekstu, niż finalnie ma być, a resztę dodać poprawnie później. Wygenerowane tło z jednym czytelnym słowem, dokończone w prawdziwym narzędziu projektowym, wygrywa z obrazem, w którym „na twardo” zakodowano akapit prawie-poprawnego pisma.

Gdzie mieści się na tle reszty katalogu

Wobec Stable Diffusion to nowsza praca pokrewnych osób: ogólnie mocniejszy wynik i lepsze trzymanie się instrukcji, kosztem znacznie mniejszego „magazynu” społecznych checkpoints i adapterów stylu.

Wobec Midjourney jest mniej opiniotwórczy. Midjourney zrobi coś z wyraźnym punktem widzenia z krótkiego promptu; FLUX zrobi to, o co Państwo proszą — lepiej, gdy wiedzą Państwo dokładnie, czego chcą, gorzej, gdy liczą Państwo na zaskoczenie.

Wobec modeli zamkniętych podpiętych do asystentów to ten, który faktycznie można uruchomić lub hostować samodzielnie — co ma znaczenie, gdy przepustowość, prywatność lub odtwarzalność to wymagania, a nie preferencje.

Do czego LaFoto go używa

Fotografie na tej stronie generujemy rodziną FLUX — galeria podaje model na każdej karcie, obok promptu i seed, więc to twierdzenie jest weryfikowalne, a nie deklaratywne. Nie mamy relacji komercyjnej z Black Forest Labs; to narzędzie, za które płacimy jak każdy.

Mówimy, który model wygenerował obraz, bo serwis, który argumentuje za rzemiosłem promptu, a ilustruje to obrazami o nieujawnionym pochodzeniu, podważa własną tezę. Jeśli prompty w galerii są prawdziwe, da się je uruchomić — a nazwa modelu jest częścią możliwości ich odtworzenia.

Instrukcja ponad estetykę

Model, który mniej się z Państwem spiera

Najczęstsza relacja osób, które się na niego przesiadły: robi to, co mu kazano. Trzy nazwane obiekty w opisanym układzie wracają jako trzy obiekty w tym układzie, a nie jako ładny obraz zawierający dwa z nich.

To jest trade-off, nie darmowy zysk. Model ściśle podążający za instrukcją nie uratuje leniwego promptu, więc mgliste wejście daje mglisty wynik zamiast być „dopieszczone” w coś efektownego.

Fotograficzny wydruk obok pisanej na maszynie listy ujęć na jasnym stole studyjnym

Trzy warianty, trzy kompromisy

To, który FLUX uruchamia usługa, zmienia, co wolno robić

Destylowany pod szybkość

Zbudowany, by w niewielu krokach oddać użyteczny obraz, co czyni go praktycznym wyborem do podglądów, iteracji i generowania masowego.

Jakość jest niższa od większych wariantów na najwyższym poziomie — różnica najmocniej widać się w drobnych fakturach i złożonych scenach.

  • Najmniej kroków, najniższe opóźnienie.
  • Dobry do iteracji nad promptem.
  • Najbardziej liberalna licencja w rodzinie.
Wygenerowana przez AI produktowa martwa natura

Pytania o FLUX

Co wychodzi przy przesiadce

Różnice praktyczne względem tego, czego większość używała wcześniej.

Dlaczego moje stare prompty działają gorzej?

Prompty dostrajane do modelu o silnej estetyce bywają wypchane „tokenami jakości” i słowami stylu, które robiły za model jego robotę. Tutaj ta wyściółka konkuruje z właściwym opisem.

Co powinien zawierać prompt zamiast tego?

Najpierw temat, potem medium, światło i optyka. Rzeczowniki konkretne i terminy fotograficzne faktycznie przesuwają wynik; przymiotniki typu senny czy epicki nie mają spójnego znaczenia wizualnego, by na nie zareagować.

Czy naprawdę potrafi wyrenderować tekst?

Krótkie ciągi — często na tyle dobrze, by dało się wokół nich projektować. Dłuższe wciąż się degradują i żaden model obrazowy nie zastąpi prawidłowego składu typograficznego na końcu.

Czy potrzebny jest negative prompt?

Wiele endpointów FLUX nie ma w ogóle kanału negatywnego, więc wszystko, co Państwo piszą, jest instrukcją pozytywną. Wpisanie „no text” do takiego endpointu — prosi o tekst.

Czy istnieje dla niego ekosystem LoRA?

Rośnie, ale jest dużo mniejszy niż zasób zbudowany wokół Stable Diffusion przez kilka lat. Jeśli zależą Państwu na konkretnej stylistyce społeczności, proszę sprawdzić przed przesiadką.

Który wariant stworzył obrazy na tej stronie?

Galeria podaje model na każdej karcie obok promptu i seedu, więc da się to sprawdzić, a nie tylko przyjąć na słowo.

Zdjęcie jedzenia wygenerowane przez AI w świetle dziennym

Proszę eksplorować dalej

W innych miejscach LaFoto

Strony tutaj są ilustrowane tym modelem.

FLUX.1 — questions people ask

Czym jest FLUX.1?
Rodzina modeli text-to-image od Black Forest Labs, firmy założonej przez badaczy, którzy wcześniej pracowali nad Stable Diffusion.
Kto stworzył FLUX?
Black Forest Labs. Założyciele wyszli z zespołu stojącego za Stable Diffusion.
Czy FLUX jest darmowy w użyciu?
To zależy od wariantu. Część można pobrać, część jest tylko przez API, a warianty do pobrania nie zawsze pozwalają na użytek komercyjny. Obowiązuje licencja konkretnego wariantu.
Czym różnią się FLUX schnell, dev i pro?
W skrócie: schnell jest destylowany pod szybkość w bardzo małej liczbie kroków, dev to „środkowa” opcja do pobrania z warunkami licencyjnymi, a pro to najwyższy wariant dostępny przez API, a nie jako plik.
Czy FLUX jest lepszy niż Stable Diffusion?
Pod względem jakości wyniku i wierności promptowi — zwykle tak. Pod względem bogactwa społecznych checkpoints, adapterów stylu i narzędzi kontroli — nie; ten ekosystem jest dużo większy wokół Stable Diffusion.
Czy FLUX potrafi generować czytelny tekst w obrazach?
Krótkie ciągi — często. Jest w tym wyraźnie lepszy niż wcześniejsze modele diffusion, ale dłuższe fragmenty nadal się degradują i to nie zastępuje prawidłowego składu tekstu.
Czy LaFoto używa FLUX?
Tak, do obrazów na tej stronie. Każda karta w galerii podaje użyty model, prompt i seed.
Dlaczego FLUX zdaje się ignorować nieprecyzyjne prompty?
Trzyma się instrukcji zamiast narzucać własną estetykę, więc nieprecyzyjny prompt zwróci nieprecyzyjny obraz, zamiast „schlebiać” mu czymś efektownym. Precyzyjne prompty są tu proporcjonalnie nagradzane.

Zacznij tworzyć dziś

Wygeneruj pierwszy obraz w najlepszym generatorze obrazów AI.

Zamień zdanie w gotowy, fotorealistyczny obraz w kilka sekund — a potem dopracuj każdy szczegół. Bez konfiguracji, bez Discorda, bez GPU.

Dołącz do 4200+ twórców korzystających z LaFoto