Black Forest Labs · model directory
FLUX.1 คืออะไร โมเดลที่อยู่เบื้องหลังคุณภาพภาพรุ่นปัจจุบันจำนวนมาก
FLUX.1 คือครอบครัวโมเดลภาพจาก Black Forest Labs ก่อตั้งโดยอดีตนักวิจัย Stable Diffusion อธิบายรุ่นย่อย และเหตุผลที่มันทำตาม prompt ได้ใกล้เคียง
FLUX.1 at a glance
- ผู้พัฒนา
- Black Forest Labs
- สายพัฒนามาจาก
- อดีตนักวิจัย Stable Diffusion
- รุ่นย่อย
- เร็ว, dev, pro
- เป็นที่รู้จักเรื่อง
- ทำตาม prompt ตรง ข้อความอ่านออก
- น้ำหนักโมเดล
- เปิดสำหรับบางรุ่นย่อย
- ใช้บนไซต์นี้เพื่อ
- ภาพประกอบบนไซต์นี้
รุ่นย่อย และเหตุผลที่ควรรู้ก่อนเริ่ม
FLUX ไม่ได้มีแค่โมเดลเดียว ครอบครัวแยกเป็นรุ่นย่อยที่กลั่นให้เร็ว สร้างภาพใช้ได้ในไม่กี่สเต็ป รุ่นกลางที่ดาวน์โหลดได้แบบเปิดแต่มีเงื่อนไขเชิงพาณิชย์ และรุ่นท็อปที่ให้ผ่านส่วนติดต่อโปรแกรม (API) ไม่ใช่ไฟล์
ผลที่สำคัญกว่าคือกฎหมาย ไม่ใช่เทคนิค การเลือกใช้รุ่นที่ดาวน์โหลดได้เพราะสะดวก แล้วนำผลลัพธ์ไปใช้งานเชิงพาณิชย์ คือความผิดพลาดที่เกิดบ่อย สิทธิ์ตามใบอนุญาต ไม่ใช่ตัวโมเดล จะเป็นตัวกำหนดว่าทำได้หรือไม่
โปรดตรวจว่าบริการโฮสต์กำลังรันรุ่นใดย่อยอยู่ ก่อนจะสรุปว่าสามารถทำอะไรกับผลลัพธ์ได้บ้าง บริการมักไม่ระบุชัด และคำตอบนี้เปลี่ยนสิ่งที่ท่านเป็นเจ้าของ
เหตุผลที่มันทำตาม prompt ได้ใกล้เคียงกว่า
ประสบการณ์จริงที่ผู้ใช้รายงานคือมันเถียงน้อย ขอวัตถุสามชิ้นจัดวางแบบเฉพาะ มักได้วัตถุสามชิ้นจัดวางตามนั้น แทนที่จะได้ภาพสวยที่มีสองชิ้นและจัดวางต่างไป
แต่นั่นแลกกับสิ่งจริงจัง โมเดลที่ยึดคำสั่งแน่นจะไม่ค่อยช่วยยกระดับ prompt ที่กลาง ๆ คำสั่งกว้างจึงคืนภาพกว้าง แทนที่จะได้ภาพเด่น โมเดลที่มีความเห็นเชิงสไตล์แรงจะทำให้ prompt ขี้เกียจดูดีขึ้นแต่จะสู้กับคำสั่งเจาะจง นี่คือปลายอีกด้านของสมดุลนั้น
ผลเชิงปฏิบัติคือ รายละเอียดได้รับผลตอบแทนที่ชัดในที่นี่มากกว่าที่อื่น ระบุแสง ระยะโฟกัส และสื่อ จะเปลี่ยนผลลัพธ์ได้เห็นได้ชัด นี่คือเหตุผลที่คำแนะนำ prompt บนไซต์นี้เขียนในกรอบดังกล่าว
ข้อความในภาพ ที่เคยเป็นจุดสังเกต
ตัวอักษรที่อ่านออกเคยเป็นวิธีเช็กภาพที่สร้างขึ้นได้แน่นปึ้ก ป้ายมักออกมาเป็นตัวอักษรคล้ายจริงแต่ไม่ใช่คำ เพราะโมเดล diffusion ประกอบรูปทรงตัวอักษรจากสถิติภาพ ไม่ได้สะกดคำ
FLUX ดีกว่ามากในเรื่องนี้ และสตริงสั้น ๆ — คำเดียวบนป้าย ฉลากบนแพ็กเกจ ชื่อบนโปสเตอร์ — มักอ่านออกพอให้ใช้วางแผนออกแบบได้ แต่มันไม่ใช่เอนจินจัดวางตัวอักษร: ข้อความยาวยังเสื่อม และยิ่งยาวโอกาสยิ่งแย่
เทคนิคที่ใช้ได้จริงคือขอข้อความให้น้อยกว่าที่ต้องการ แล้วเติมให้สมบูรณ์ในเครื่องมือออกแบบจริง ภาพฉากหลังที่สร้างพร้อมคำที่อ่านออกหนึ่งคำ แล้วไปจบในเครื่องมือจริง จะชนะภาพที่พยายามอบย่อหน้าที่ยังสะกดเกือบถูกลงไปในพิกเซล
ตำแหน่งเมื่อมองเทียบกับทั้งสารบบ
เมื่อเทียบกับ Stable Diffusion มันคือผลงานใหม่กว่าจากทีมที่ทับซ้อนกัน: ผลลัพธ์โดยรวมแข็งแรงกว่าและทำตามคำสั่งดีกว่า แลกกับจำนวน checkpoints และตัวแปลงสไตล์จากชุมชนที่ยังน้อยกว่า
เมื่อเทียบกับ Midjourney มันมีความเห็นเชิงสไตล์น้อยกว่า Midjourney จะสร้างงานที่มีมุมมองจาก prompt สั้น ๆ ส่วน FLUX จะทำตามที่ท่านขอ ซึ่งดีกว่าเมื่อท่านรู้เป้าชัด และแย่กว่าเมื่อท่านหวังให้โมเดลเซอร์ไพรส์
เมื่อเทียบกับโมเดลที่ผูกกับผู้ช่วยแบบปิด มันคือโมเดลที่ท่านรันหรือโฮสต์เองได้จริง ซึ่งสำคัญเมื่อข้อจำกัดเรื่องปริมาณงาน ความเป็นส่วนตัว หรือการทำซ้ำได้ เป็นเงื่อนไขมากกว่าเป็นความชอบ
LaFoto ใช้มันทำอะไร
ภาพถ่ายบนไซต์นี้สร้างด้วยตระกูล FLUX — หน้าแกลเลอรีระบุโมเดลบนการ์ดทุกใบคู่กับ prompt และ seed จึงตรวจสอบได้จริง ไม่ใช่กล่าวอ้างลอย ๆ เราไม่มีความสัมพันธ์ทางการค้ากับ Black Forest Labs มันเป็นเครื่องมือที่เราจ่ายใช้เหมือนคนอื่น
เหตุผลที่เราบอกว่าแต่ละภาพเกิดจากโมเดลใด ก็เพราะไซต์ที่ชี้ให้เห็นคุณค่าของงาน craft ด้าน prompt แต่ไม่ยอมเปิดเผยที่มาของภาพตนเอง กำลังทำลายข้อโต้แย้งของตัวเอง หาก prompt บนหน้าแกลเลอรีเป็นของจริง ก็ต้องรันซ้ำได้ และชื่อโมเดลคือส่วนหนึ่งของการรันนั้น
เชื่อคำสั่งเหนือสไตล์
โมเดลที่ “แย้งกับท่าน” น้อยลง
เสียงสะท้อนสม่ำเสมอจากผู้ที่ย้ายมาใช้คือ มันทำตามที่สั่ง สามวัตถุที่ระบุชื่อในตำแหน่งที่อธิบาย จะกลับมาเป็นสามวัตถุในตำแหน่งนั้น ๆ แทนที่จะเป็นภาพสวยที่ขาดไปหนึ่งชิ้น
นี่คือข้อแลก ไม่ใช่ของแถม โมเดลที่ตามคำสั่งเป๊ะจะไม่ช่วย “แต่ง” prompt ที่สะเพร่า คำสั่งกำกวมย่อมได้ผลลัพธ์กำกวม แทนที่จะถูกยกให้ดูโดดเด่น

สามรุ่น ย่อมมีสามข้อแลก
บริการใช้ FLUX รุ่นใด กระทบสิ่งที่ท่านทำได้
รุ่นกลั่นเพื่อความเร็ว
ออกภาพที่ใช้การได้ในไม่กี่สเต็ป เหมาะจริงกับพรีวิว ไอเทอเรชัน และงานที่ต้องยิงปริมาณมาก
คุณภาพปลายบนด้อยกว่ารุ่นใหญ่ และช่องว่างจะเห็นชัดในพื้นผิวละเอียดและฉากซับซ้อน
- สเต็ปน้อยสุด หน่วงต่ำสุด
- เหมาะกับการลองปรับ prompt
- สัญญาอนุญาตผ่อนปรนที่สุดในตระกูล

weights เปิด ใบอนุญาตมีเงื่อนไข
รุ่นที่ระบบโฮสต์เองส่วนใหญ่ใช้ ดาวน์โหลดได้ คุณภาพแข็งแรง แต่มีเงื่อนไขสัญญาอนุญาตที่จำกัดการใช้งานเชิงพาณิชย์
อ่านเงื่อนไขก่อนสร้างอะไรทับบนมัน การดาวน์โหลดได้ ไม่เท่ากับผลลัพธ์ “ปลอดเงื่อนไข”
- ดาวน์โหลดและโฮสต์เองได้
- ใบอนุญาตจำกัดการใช้งานเชิงพาณิชย์
- ตัวเลือกหลักของชุมชน

เฉพาะผ่าน API คุณภาพสูงสุด
หัวตระกูล เข้าถึงผ่าน API ไม่ใช่ไฟล์ นี่แหละที่ผลิตภัณฑ์โฮสต์ส่วนใหญ่ซึ่งโชว์คุณภาพระดับ FLUX เรียกใช้อยู่จริง
สละการรันโลคัลและการตรึงเวอร์ชัน แลกกับผลลัพธ์ที่ดีที่สุดของตระกูล โดยไม่ต้องดูแลระบบใด ๆ
- ไม่มีตัวรันโลคัล
- คิดตามจำนวนภาพ
- สิ่งที่บริการโฮสต์ส่วนใหญ่ใช้

คำถามเกี่ยวกับ FLUX
สิ่งที่มักเกิดเมื่อย้ายมาใช้มัน
ความต่างเชิงปฏิบัติจากสิ่งที่คนส่วนใหญ่เคยใช้
ทำไม prompt เก่าใช้แล้วแย่ลง?
prompt ที่จูนเพื่อโมเดลสไตล์จัด มักบวมด้วยคำยกคุณภาพและคำสไตล์ที่ไปทำงานแทนโมเดล ที่นี่คำบวมนั้นจะไปแย่งกับ “คำบรรยายจริง”
แล้วควรเขียน prompt อย่างไร?
ใส่หัวเรื่อง ตามด้วยสื่อ แสง และออปติก คำนามรูปธรรมและคำศัพท์การถ่ายภาพมีผลชัด ส่วนคำคุณศัพท์อย่าง ละมุน ฝัน ๆ ยิ่งใหญ่ ไม่มีภาพแทนที่สม่ำเสมอให้ยึด
เรนเดอร์ตัวอักษรได้จริงไหม?
สตริงสั้น ๆ มักดีพอให้ดีไซน์ต่อได้ ข้อความยาวยังเสื่อมลง และไม่มีโมเดลภาพตัวใดแทนการจัดตัวพิมพ์อย่างถูกต้องภายหลังได้
ต้องมี negative prompt ไหม?
เอ็นด์พอยต์ FLUX จำนวนมากไม่มีช่องลบ แปลว่าทุกอย่างที่เขียนคือคำสั่งเชิงบวก การเขียน “no text” ลงในเอ็นด์พอยต์แบบนี้คือการขอ “มีข้อความ”
มีระบบนิเวศ LoRA ไหม?
กำลังเติบโต แต่อีกมากกว่าจะทัดเทียมคลังมหาศาลที่สร้างรอบ Stable Diffusion มาหลายปี หากพึ่งสไตล์ชุมชนเฉพาะ ให้ตรวจสอบก่อนย้าย
ภาพในไซต์นี้มาจากรุ่นใด?
ในแกลเลอรีระบุโมเดลบนการ์ดทุกใบคู่กับ prompt และ seed ให้ตรวจสอบได้ ไม่ใช่บอกปากเปล่า

การเขียน prompt สำหรับโมเดลที่ตรงตัว
เขียนอย่างไรเมื่อโมเดล “ตีความตามคำพูด”
สำรวจต่อ
หน้าอื่น ๆ บน LaFoto
หน้าบนไซต์นี้แสดงด้วยโมเดลตระกูลนี้
- ปรับขนาดภาพ
- แปลงรูปแบบภาพ
- ลดขนาดไฟล์
- ตัวครอปภาพ
- ดึงค่าสีจากภาพ
- ตัวลบฉากหลัง
- EXIF viewer
- ตัวสร้าง prompt ด้วย AI
- สร้างงานศิลปะแนวอนิเมะ
- ทำภาพให้เป็นการ์ตูน
- สร้างพิกเซลอาร์ต
- ตัวสร้างภาพ AI ที่ดีที่สุด
- เทียบกับ Midjourney
- เทียบกับ Leonardo
- เทียบกับ Ideogram
- เทียบกับ Canva
- อธิบาย seed
- อธิบาย denoise strength
- แก้ไขภายในมาสก์
- คู่มือและบทอธิบาย
FLUX.1 — questions people ask
- FLUX.1 คืออะไร
- ครอบครัวโมเดลข้อความเป็นภาพจาก Black Forest Labs บริษัทที่ก่อตั้งโดยนักวิจัยที่เคยทำงานในโครงการ Stable Diffusion
- ใครเป็นผู้พัฒนา FLUX
- Black Forest Labs ผู้ก่อตั้งมาจากทีมเบื้องหลัง Stable Diffusion
- FLUX ใช้ฟรีไหม
- ขึ้นกับรุ่นย่อย บางรุ่นดาวน์โหลดได้ บางรุ่นให้ผ่านส่วนติดต่อโปรแกรม (API) และรุ่นที่ดาวน์โหลดได้ไม่ใช่ทุกตัวที่อนุญาตใช้เชิงพาณิชย์ ใบอนุญาตของรุ่นย่อยที่ท่านใช้คือสิ่งที่กำกับสิทธิ์
- ความต่างระหว่าง FLUX schnell, dev และ pro คืออะไร
- โดยกว้าง: schnell กลั่นเพื่อความเร็วในไม่กี่สเต็ป dev คือรุ่นกลางที่ดาวน์โหลดได้พร้อมเงื่อนไขใบอนุญาต และ pro คือรุ่นคุณภาพสูงสุดที่ให้ผ่าน API ไม่ใช่ไฟล์
- FLUX ดีกว่า Stable Diffusion ไหม
- ด้านคุณภาพผลลัพธ์และการทำตาม prompt โดยทั่วไปดีกว่า ด้านความกว้างของ checkpoints ชุมชน ตัวแปลงสไตล์ และเครื่องมือควบคุมที่มีอยู่ รอบ Stable Diffusion ยังใหญ่กว่ามาก
- FLUX สร้างข้อความในภาพที่อ่านออกได้ไหม
- สตริงสั้น ๆ ได้บ่อย มันดีกว่าโมเดล diffusion รุ่นก่อนมาก แต่ข้อความยาวยังเสื่อม และไม่ใช่ตัวแทนการจัดวางตัวอักษรจริง
- LaFoto ใช้ FLUX ไหม
- ใช้ สำหรับภาพบนไซต์นี้ การ์ดทุกใบในแกลเลอรีระบุโมเดล prompt และ seed ที่ใช้สร้างไว้ครบถ้วน
- ทำไม FLUX ดูเหมือนไม่สนใจ prompt กว้าง ๆ
- มันทำตามคำสั่งอย่างใกล้ชิดแทนที่จะยัดสไตล์ของตัวเอง ดังนั้น prompt กว้างจึงได้ภาพกว้าง แทนที่จะถูกแต่งให้ดูโดดเด่น prompt ที่เฉพาะเจาะจงจะได้ผลดีกว่าเป็นสัดส่วน
เริ่มสร้างวันนี้
สร้างภาพแรกของท่านด้วยตัวสร้างภาพ AI ที่ดีที่สุด
แปลงประโยคเป็นภาพจริงสมจริงในไม่กี่วินาที — แล้วปรับรายละเอียดได้ครบ ไม่ต้องตั้งค่า ไม่ต้องใช้ Discord หรือ GPU
เข้าร่วมกับครีเอเตอร์ 4,200+ คนที่ใช้ LaFoto