Bỏ qua tới nội dung
LaFoto

Black Forest Labs · model directory

FLUX.1 là gì? Mô hình đứng sau nhiều chất lượng ảnh hiện nay

FLUX.1 là họ mô hình ảnh của Black Forest Labs, do các nhà nghiên cứu từng làm Stable Diffusion sáng lập. Các biến thể và lý do nó bám prompt chặt.

FLUX.1 là họ mô hình text-to-image từ Black Forest Labs, công ty do các nhà nghiên cứu từng làm Stable Diffusion sáng lập. Nó nổi tiếng vì bám prompt sát hơn các mô hình mở trước đây và vì hiển thị chữ đọc được trong ảnh, và có nhiều biến thể đánh đổi giữa tốc độ, điều khoản giấy phép và chất lượng.

FLUX.1 at a glance

Nhà phát triển
Black Forest Labs
Nguồn gốc
Các nhà nghiên cứu từng làm Stable Diffusion
Biến thể
schnell, dev, pro
Nổi tiếng vì
Bám prompt, chữ rõ ràng
Trọng số
Mở với một số biến thể
LaFoto dùng để
Hình ảnh trên chính trang này

Các biến thể và vì sao cần phân biệt ngay từ đầu

FLUX không phải một mô hình đơn. Họ này tách thành một biến thể chưng cất nhanh để tạo ảnh dùng được trong rất ít bước, một biến thể giữa có thể tải công khai nhưng kèm điều kiện giấy phép hạn chế thương mại, và một biến thể cao cấp cung cấp qua API thay vì tệp.

Hệ quả quan trọng là pháp lý hơn kỹ thuật. Chọn biến thể có thể tải vì tiện, rồi dùng đầu ra vào mục đích thương mại, là lỗi thường gặp nhất, và giấy phép — chứ không phải mô hình — quyết định điều đó có được phép hay không.

Hãy kiểm tra dịch vụ lưu trữ đang chạy biến thể nào trước khi giả định quyền sử dụng kết quả. Dịch vụ không phải lúc nào cũng nói rõ, và câu trả lời quyết định thứ quý vị sở hữu.

Vì sao nó bám prompt chặt hơn

Trải nghiệm thực tế mọi người ghi nhận là nó ít "cãi" hơn. Yêu cầu ba vật thể cụ thể sắp theo cách nhất định thì khả năng cao là quý vị nhận đúng ba vật thể xếp như vậy, thay vì một bức đẹp với hai vật và bố cục khác.

Đổi lại có đánh đổi thật. Mô hình tuân chỉ dẫn chặt chẽ ít có xu hướng nâng cấp một prompt tầm thường, nên yêu cầu mơ hồ trả về bức ảnh mơ hồ thay vì một bức ấn tượng. Những mô hình có quan điểm thẩm mỹ mạnh sẽ làm đẹp cho prompt lười và chống lại prompt cụ thể; đây là đầu kia của cán cân đó.

Hệ quả thực hành là chi tiết được tưởng thưởng ở đây theo cách không phải nơi nào cũng vậy. Gọi tên ánh sáng, tiêu cự và chất liệu ảnh hưởng rõ rệt tới kết quả, nên hướng dẫn prompt trên site này mới viết theo các yếu tố đó.

Văn bản trong ảnh, dấu hiệu từng rất dễ nhận

Chữ đọc được từng là cách đáng tin để nhận ra ảnh sinh thành. Biển hiệu thường thành chữ giả có vẻ hợp lý vì mô hình khuếch tán ghép hình chữ từ thống kê thị giác thay vì đánh vần.

FLUX cải thiện đáng kể, và chuỗi ngắn — một từ trên biển, nhãn trên gói, tiêu đề trên poster — thường đủ đọc để có thể thiết kế xoay quanh. Nó không phải công cụ dàn trang: đoạn dài vẫn suy giảm, chuỗi càng dài càng kém.

Kỹ thuật thực tế là yêu cầu ít chữ hơn nhu cầu thật và thêm phần còn lại bằng công cụ thiết kế chuẩn. Một nền sinh thành với một từ đọc được, rồi hoàn thiện bằng công cụ thật, tốt hơn một bức sinh thành nhét cả đoạn chữ gần đúng vào pixel.

Vị trí của nó trong thư mục này

So với Stable Diffusion, đây là công trình mới hơn của những người có nhiều chỗ giao thoa: đầu ra mạnh hơn và tuân prompt tốt hơn, đổi lại kho checkpoint cộng đồng và bộ thích nghi phong cách ít hơn nhiều.

So với Midjourney, nó ít áp đặt quan điểm hơn. Midjourney sẽ tạo ra thứ có điểm nhìn từ một prompt ngắn; FLUX sẽ tạo đúng thứ quý vị yêu cầu, hữu ích khi quý vị biết chính xác mình muốn gì và kém hơn khi quý vị trông chờ sự bất ngờ.

So với các mô hình đóng gắn với trợ lý, đây là mô hình quý vị thực sự có thể tự chạy hoặc tự host, điều quan trọng khi thông lượng, riêng tư hay khả năng lặp lại là ràng buộc chứ không chỉ sở thích.

LaFoto dùng để làm gì

Các bức ảnh trên site này được tạo bằng họ FLUX — trang gallery ghi rõ mô hình trên từng thẻ cùng prompt và seed, nên tuyên bố có thể kiểm chứng chứ không phải lời nói suông. Chúng tôi không có quan hệ thương mại với Black Forest Labs; đây là công cụ chúng tôi trả tiền như mọi người khác.

Lý do chúng tôi nêu mô hình tạo ảnh là vì một site kêu gọi đầu tư vào craft của prompt nhưng minh họa bằng ảnh mà không công khai nguồn gốc thì tự làm yếu lập luận của mình. Nếu prompt trên trang gallery là thật, chúng có thể được chạy lại, và tên mô hình là một phần để làm được điều đó.

Ưu tiên chỉ dẫn hơn thẩm mỹ

Một mô hình ít cãi lệnh hơn

Người chuyển sang nó thường nói rằng mô hình làm đúng điều được yêu cầu. Ba vật thể có tên trong một bố cục mô tả sẽ trở về đúng ba vật thể trong bố cục đó, thay vì một bức ảnh đẹp chỉ có hai.

Đó là đánh đổi chứ không phải thắng lợi miễn phí. Mô hình bám sát chỉ dẫn sẽ không “cứu” một prompt cẩu thả, nên đầu vào mơ hồ sẽ trả về kết quả mơ hồ, thay vì được “tâng” lên thành thứ bắt mắt.

Bản in ảnh bên cạnh danh sách cảnh quay gõ máy trên bàn studio sáng

Ba biến thể, ba đánh đổi

Dịch vụ chạy FLUX nào sẽ quyết định quý vị được làm gì

Chưng cất để tăng tốc

Tạo ra ảnh dùng được chỉ trong rất ít bước, hợp lý cho xem thử, lặp nhanh và mọi thứ tạo ảnh với số lượng lớn.

Chất lượng thấp hơn các biến thể lớn ở phần đỉnh, rõ nhất ở chi tiết mịn và cảnh phức tạp.

  • Ít bước nhất, độ trễ thấp nhất.
  • Tốt để lặp trên prompt.
  • Giấy phép “thoáng” nhất trong họ.
Tĩnh vật sản phẩm do AI tạo

Câu hỏi về FLUX

Những điều nảy sinh khi người dùng chuyển sang nó

Các khác biệt thực tế so với những gì đa số từng dùng.

Vì sao prompt cũ hoạt động kém hơn?

Prompt tinh chỉnh cho mô hình có thẩm mỹ mạnh thường nhồi token chất lượng và từ mô tả phong cách để làm thay việc của mô hình. Ở đây, phần nhồi đó lại cạnh tranh với mô tả thực sự.

Prompt nên chứa gì thay thế?

Chủ thể, rồi chất liệu/loại hình, rồi ánh sáng, rồi quang học. Danh từ cụ thể và thuật ngữ nhiếp ảnh làm dịch chuyển đầu ra; tính từ kiểu mơ mộng hay hoành tráng không có nghĩa thị giác nhất quán để tác động.

Nó có thực sự dựng được chữ không?

Chuỗi ngắn, thường đủ tốt để thiết kế quanh đó. Đoạn dài vẫn suy giảm, và không mô hình ảnh nào thay thế cho việc dàn chữ đúng bài sau đó.

Có cần negative prompt không?

Nhiều endpoint FLUX không có kênh negative, tức mọi điều quý vị viết đều là chỉ dẫn dương. Viết “no text” vào một endpoint như vậy thực ra đang yêu cầu có chữ.

Có hệ sinh thái LoRA cho nó không?

Đang lớn dần, và nhỏ hơn nhiều so với kho tích lũy quanh Stable Diffusion qua nhiều năm. Nếu phụ thuộc một phong cách cộng đồng cụ thể, hãy kiểm tra trước khi chuyển.

Những ảnh trên trang này do biến thể nào tạo?

Bộ sưu tập nêu rõ mô hình trên từng thẻ cùng prompt và seed, để có thể kiểm chứng thay vì chỉ khẳng định.

Một ảnh đồ ăn do AI tạo trong ánh sáng ban ngày

Khám phá tiếp

Những nơi khác trên LaFoto

Các trang ở đây được minh họa bằng mô hình này.

FLUX.1 — questions people ask

FLUX.1 là gì?
Một họ mô hình text-to-image của Black Forest Labs, công ty do các nhà nghiên cứu từng làm Stable Diffusion sáng lập.
Ai làm ra FLUX?
Black Forest Labs. Những người sáng lập xuất thân từ đội ngũ đứng sau Stable Diffusion.
FLUX có miễn phí không?
Phụ thuộc biến thể. Có biến thể có thể tải và có biến thể chỉ qua API, và các biến thể có thể tải không phải tất cả đều cho phép thương mại. Giấy phép của biến thể cụ thể là điều khoản chi phối.
Khác nhau giữa FLUX schnell, dev và pro là gì?
Tóm lược: schnell được chưng cất để chạy nhanh với rất ít bước, dev là lựa chọn giữa có thể tải kèm điều kiện giấy phép, còn pro là biến thể chất lượng cao nhất cung cấp qua API thay vì tệp.
FLUX có tốt hơn Stable Diffusion không?
Về chất lượng đầu ra và bám prompt, nói chung là có. Về độ phong phú checkpoint cộng đồng, bộ thích nghi phong cách và công cụ điều khiển sẵn có, thì không — hệ sinh thái quanh Stable Diffusion lớn hơn nhiều.
FLUX có tạo được chữ đọc được trong ảnh không?
Chuỗi ngắn thì thường có. Nó vượt trội rõ rệt so với các mô hình khuếch tán trước đây ở khoản này, nhưng đoạn dài vẫn suy giảm và nó không thay thế cho việc dàn chữ đúng cách.
LaFoto có dùng FLUX không?
Có, cho hình ảnh trên site này. Mỗi thẻ trong gallery đều liệt kê mô hình, prompt và seed dùng để tạo.
Vì sao FLUX có vẻ phớt lờ prompt mơ hồ?
Nó bám chỉ dẫn chặt thay vì áp thẩm mỹ riêng, nên prompt mơ hồ trả về ảnh mơ hồ thay vì được "tô đẹp" thành thứ ấn tượng. Prompt cụ thể sẽ được tưởng thưởng tương xứng.

Bắt đầu sáng tạo hôm nay

Tạo bức ảnh đầu tiên với trình tạo ảnh AI tốt nhất.

Biến một câu thành ảnh hoàn thiện, như thật trong vài giây — rồi chỉnh từng chi tiết. Không cần cài đặt, không cần Discord, không cần GPU.

Tham gia 4.200+ creator đang dùng LaFoto