Black Forest Labs ได้เปิดตัว FLUX 3 Image เมื่อวันที่ 1 ตุลาคม 2026 โมเดลใหม่นี้สร้างและแก้ไขภาพนิ่ง, รวมการอ้างอิงได้สูงสุด 10 รายการ และรองรับเอาต์พุตความละเอียดสูงแบบเนทีฟถึง 4K คุณสมบัติที่โดดเด่นที่สุดคือการควบคุม: คุณสามารถระบุตำแหน่งขององค์ประกอบต่างๆ จากนั้นเปลี่ยนส่วนที่เลือกของภาพในขณะที่พยายามรักษาส่วนที่เหลือไว้
สำหรับนักออกแบบ, ผู้สร้าง และทีมที่สร้างเนื้อหาทางการตลาด นั่นหมายถึงมากกว่าวิธีการสร้างภาพที่น่าสนใจอีกวิธีหนึ่ง FLUX 3 Image นำการวางแผนองค์ประกอบ, การสร้างตามการอ้างอิง และการแก้ไขเป้าหมายมารวมอยู่ในโมเดลเดียวกัน นี่คือความสามารถหลักหกประการ, ประโยชน์ของมัน และข้อจำกัดที่ควรทราบก่อนที่คุณจะลองใช้
อ้างอิงจากบันทึกการเผยแพร่ของ Black Forest Labs เมื่อวันที่ 1 ตุลาคม และเอกสารผลิตภัณฑ์ปัจจุบัน ตรวจสอบเมื่อวันที่ 3 ตุลาคม 2026 นี่คือภาพรวมความสามารถ ไม่ใช่การทดสอบภาคปฏิบัติ ภาพประกอบเป็นแผนภาพอธิบายต้นฉบับ ไม่ใช่ผลลัพธ์จาก FLUX 3
FLUX 3 Image คืออะไร?
FLUX 3 Image คือข้อเสนอการสร้างและแก้ไขภาพนิ่งในตระกูล FLUX 3 ของ Black Forest Labs ตระกูลที่กว้างขึ้นได้รับการประกาศในเดือนกรกฎาคม แต่การเปิดตัวในเดือนตุลาคมนี้ทำให้โมเดลภาพพร้อมใช้งานสำหรับการสร้างและแก้ไขภาพ FLUX 3 Video และคุณสมบัติเสียงเป็นความสามารถที่แยกต่างหาก การสร้างภาพไม่ได้สร้างวิดีโอด้วย
คุณสามารถเริ่มต้นจากคำอธิบายที่เป็นลายลักษณ์อักษร, อัปโหลดรูปภาพเพื่อแก้ไข หรือให้ข้อมูลอ้างอิงหลายรายการสำหรับองค์ประกอบใหม่ Playground อย่างเป็นทางการมีจุดเริ่มต้นแบบภาพ ในขณะที่ BFL API รองรับการสร้างและการแก้ไขผ่านจุดสิ้นสุดเดียว
| ความสามารถ | สิ่งที่คุณทำได้ | มีประโยชน์ในด้านใด |
|---|---|---|
| การสร้างภาพและการแสดงผลข้อความ | สร้างภาพถ่าย, ภาพประกอบ, โปสเตอร์ และภาพที่มีข้อความ | แนวคิดแคมเปญ, งานศิลปะบรรณาธิการ, กราฟิกโซเชียล |
| การจัดวางด้วยกล่องขอบเขต | กำหนดตำแหน่งและพื้นที่ให้กับองค์ประกอบสำคัญ | โปสเตอร์, ภาพปะติด, ปก, ตารางแผง |
| การแก้ไขภาพแบบกำหนดเป้าหมาย | เปลี่ยนสี, แทนที่, ย้าย, ปรับขนาด หรือลบองค์ประกอบที่เลือก | การแก้ไขภาพที่คุณชอบอยู่แล้ว |
| ภาพอ้างอิงสูงสุด 10 ภาพ | รวมหัวข้อ, ผลิตภัณฑ์, ฉาก และสไตล์ | ฉากผลิตภัณฑ์, งานตัวละคร, ความสอดคล้องทางภาพ |
| เอาต์พุตเนทีฟถึง 4K | สร้างภาพขนาดใหญ่ขึ้นพร้อมพื้นที่สำหรับรายละเอียดมากขึ้น | ภาพขนาดใหญ่และการครอบตัด |
| การอ้างอิงจากการค้นหา | อนุญาตให้การวิจัยบนเว็บและภาพเป็นข้อมูลในการสร้าง | ข้อมูลสรุปที่เกี่ยวข้องกับหัวข้อในโลกแห่งความเป็นจริงที่จดจำได้ |
1. สร้างภาพในหลากหลายสไตล์ พร้อมข้อความที่เป็นส่วนหนึ่งของการออกแบบ
FLUX 3 Image จัดการคำขอข้อความเป็นภาพทั่วไปโดยไม่จำเป็นต้องมีกล่องจัดวาง อธิบายหัวข้อ, ฉาก, แสง และสไตล์ภาพที่ต้องการ ตัวอย่างอย่างเป็นทางการครอบคลุมฉากภาพถ่าย, ภาพแฟชั่น, ภาพประกอบกราฟิก และการออกแบบโปสเตอร์
ข้อความเป็นส่วนหนึ่งของความสามารถนั้น คู่มือปัจจุบันของ BFL แสดงให้เห็นการจัดเรียงตัวอักษรหลายบรรทัดและข้อความในหลายภาษา รวมถึงภาษาญี่ปุ่นและภาษาอังกฤษในการออกแบบเดียว สิ่งนี้มีความสำคัญสำหรับโปสเตอร์, ปก, ป้าย และกราฟิกที่คำเป็นส่วนหนึ่งของภาพมากกว่าคำบรรยายที่เพิ่มเข้ามาภายหลัง
วิธีที่มีประโยชน์ในการเข้าถึงคือการระบุคำที่แน่นอน, ตำแหน่ง และการจัดวางภาพ ตัวอย่างเช่น ข้อมูลสรุปอาจขอชื่อสั้นๆ ที่ด้านบนของโปสเตอร์ โดยมีน้ำหนักและสีที่เฉพาะเจาะจง นั่นสามารถนำไปปฏิบัติได้มากกว่าการขอ “การจัดเรียงตัวอักษรที่สวยงาม” คอลเลกชันพรอมต์ ของเราสามารถช่วยคุณพัฒนาทิศทางภาพ ซึ่งคุณสามารถปรับให้เข้ากับโมเดลได้
การแสดงผลข้อความยังคงต้องมีการพิสูจน์อักษร ตรวจสอบการสะกด, เครื่องหมายวรรคตอน, ตัวพิมพ์เล็ก และลำดับการอ่านในผลลัพธ์จริง ความสามารถของโมเดลในการแสดงผลสคริปต์ไม่ได้หมายความถึงความแม่นยำที่เท่าเทียมกันสำหรับทุกภาษาหรือทุกความยาวของข้อความ
ที่มา: Black Forest Labs, Style, Aesthetics & Text.
2. ควบคุมองค์ประกอบด้วยกล่องขอบเขต
นี่คือหนึ่งในเหตุผลที่ชัดเจนที่สุดของการเปิดตัวที่ควรให้ความสนใจ แทนที่จะหวังว่า “วางชื่อเรื่องไว้ทางซ้าย” จะให้ความสมดุลที่ถูกต้อง คุณสามารถกำหนดพื้นที่ให้กับชื่อเรื่อง, บุคคล, วัตถุ หรือแผงแต่ละแผงได้
ใน Playground คุณสามารถวาดกล่องได้ ในพรอมต์ API คำอธิบายฉากจะตามด้วยตารางองค์ประกอบที่มีชื่อ, คำอธิบาย และกล่องของแต่ละองค์ประกอบ พิกัดใช้ตาราง 0–1000 ในลำดับ [top, left, bottom, right]

แผนภาพต้นฉบับของการควบคุมเลย์เอาต์ แต่ละภูมิภาคสีแสดงถึงองค์ประกอบที่อธิบายแยกกัน ไม่ใช่ภาพหน้าจอหรือผลลัพธ์ที่สร้างขึ้น
ประโยชน์คือในทางปฏิบัติ: หัวข้อสามารถมีพื้นที่ของตัวเอง, ภาพปะติดสามารถมีลำดับชั้นที่วางแผนไว้ และภาพที่แออัดสามารถกำหนดตำแหน่งให้กับหลายหัวข้อได้ สิ่งนี้มีความเกี่ยวข้องเป็นพิเศษเมื่อภาพต้องสื่อสารข้อความ ไม่ใช่แค่ดูน่าสนใจ
กล่องเป็นแนวทางในการจัดวาง ไม่ใช่มาสก์ตัดที่แข็ง BFL's documentation ระบุว่าองค์ประกอบสามารถขยายเกินขอบเขตได้ เลย์เอาต์ยังคงต้องมีการตรวจสอบด้วยสายตา โดยเฉพาะอย่างยิ่งเมื่อข้อความและหัวข้ออยู่ใกล้กัน
ที่มา: Black Forest Labs, Bounding boxes with FLUX 3 Image.
3. ทำการแก้ไขเฉพาะจุดในขณะที่รักษารูปภาพรอบข้างไว้
FLUX 3 Image สามารถแก้ไขรูปภาพที่มีอยู่ผ่านคำสั่งที่เป็นลายลักษณ์อักษร บันทึกการเผยแพร่ได้อธิบายถึงการเปลี่ยนสี, การแทนที่, การย้าย, การปรับขนาด และการลบองค์ประกอบ รวมถึงการแก้ไขหลายรายการในคำขอเดียว
สิ่งนี้มีประโยชน์เมื่อภาพโดยรวมใช้ได้ แต่ส่วนหนึ่งไม่: เสื้อผ้าต้องการสีใหม่, วัตถุต้องการตำแหน่งที่แตกต่างกัน หรืออุปกรณ์ประกอบฉากที่รบกวนควรหายไป ช่วยลดความจำเป็นในการอธิบายและสร้างฉากทั้งหมดใหม่สำหรับการแก้ไขแต่ละครั้ง

ภาพประกอบต้นฉบับของพฤติกรรมการแก้ไขเฉพาะจุดที่ตั้งใจไว้ วัตถุที่เน้นจะเปลี่ยนไป; เลย์เอาต์โดยรอบควรจะคงที่ นี่ไม่ใช่ผลลัพธ์การรักษาที่วัดได้
BFL ทำการตลาดสิ่งนี้ว่าเป็นการแก้ไขที่แม่นยำระดับพิกเซล และเอกสารประกอบแสดงตัวอย่างของพิกเซลที่ไม่เปลี่ยนแปลงนอกพื้นที่ที่แก้ไข คู่มือโดยละเอียดยังใช้คำคุณศัพท์ “โดยปกติ” ถือว่าการรักษาเป็นความสามารถที่ต้องตรวจสอบในภาพของคุณเอง โดยเฉพาะอย่างยิ่งรอบใบหน้า, โลโก้, พื้นผิวละเอียด และเงา
สำหรับการทดลองครั้งแรกที่มีประโยชน์ ให้เลือกภาพที่คุณชอบอยู่แล้วและขอการเปลี่ยนแปลงที่ชัดเจนหนึ่งอย่าง เปรียบเทียบรายละเอียดรอบข้างอย่างละเอียดเท่ากับวัตถุที่เปลี่ยนไป นั่นจะบอกคุณเพิ่มเติมเกี่ยวกับคุณภาพการแก้ไขมากกว่าการสร้างภาพที่สองที่ไม่เกี่ยวข้อง
ที่มา: Black Forest Labs, บันทึกการเผยแพร่เมื่อวันที่ 1 ตุลาคม และ Bounding boxes with FLUX 3 Image.
4. รวมการอ้างอิงสูงสุด 10 รายการในองค์ประกอบเดียว
การอ้างอิงหลายรายการช่วยให้คุณแยกสิ่งที่แต่ละแหล่งข้อมูลมีส่วนร่วมได้ หนึ่งสามารถให้ตัวละคร, อีกหนึ่งผลิตภัณฑ์, ที่สามสถานที่ และอีกหนึ่งสไตล์ภาพ FLUX 3 Image สามารถใช้ภาพอ้างอิงได้สูงสุด 10 ภาพในคำขอเดียว
สิ่งสำคัญคือการกำหนดบทบาทมากกว่าการขอให้รวมทุกอย่าง “ใช้ผลิตภัณฑ์จากภาพที่ 1 ในห้องจากภาพที่ 2 ด้วยสไตล์แสงของภาพที่ 3” ให้แต่ละการอ้างอิงมีหน้าที่ เป็นแนวทางที่มีประโยชน์สำหรับฉากผลิตภัณฑ์, แนวคิดแฟชั่น, ตัวละครที่เกิดซ้ำ และการพัฒนาภาพ
การอ้างอิงไม่ควรถือเป็นการรับประกันการทำซ้ำที่แม่นยำ เปรียบเทียบรายละเอียดที่สำคัญ: อัตลักษณ์ของบุคคล, สัดส่วนของผลิตภัณฑ์, ข้อความบนบรรจุภัณฑ์ หรือวัสดุของสินค้า การอ้างอิงเพิ่มเติมจะมีประโยชน์ก็ต่อเมื่อเพิ่มข้อมูลที่เกี่ยวข้องเท่านั้น
API อย่างเป็นทางการยอมรับการอ้างอิงตั้งแต่ 256 × 256 พิกเซล สูงสุด 16 เมกะพิกเซลต่อภาพ เมื่ออัตราส่วนภาพถูกตั้งค่าเป็น auto การอ้างอิงแรกจะกำหนดรูปร่างเอาต์พุต เลือกอัตราส่วนที่ชัดเจนหากภาพที่เสร็จแล้วต้องการรูปแบบที่แตกต่างกัน
ที่มา: Black Forest Labs, Multi-Reference Editing.
5. สร้างภาพความละเอียดสูงแบบเนทีฟถึง 4K
BFL อธิบายการเรนเดอร์ 2K และ 4K แบบเนทีฟ: โมเดลสร้างภาพขนาดใหญ่ขึ้นเอง ซึ่งแตกต่างจากการนำภาพขนาดเล็กที่เสร็จแล้วมาขยายในภายหลัง พื้นที่พิกเซลพิเศษมีประโยชน์สำหรับพื้นผิว, รายละเอียดฉากเล็กๆ และการครอบตัด
ในที่นี้ ป้ายกำกับอธิบายพื้นที่พิกเซลโดยประมาณ ไม่ใช่ขนาดเฟรมวิดีโอที่ตายตัว คลาส 4k มีขนาดประมาณ 16 เมกะพิกเซล; หน้าผลิตภัณฑ์ของ BFL แสดงตัวอย่าง 5456 × 3072 อย่าคิดว่าภาพ 4K ทุกภาพจะเป็น 3840 × 2160
| คลาสเอาต์พุต | ขนาดที่ระบุในเอกสาร | จุดเริ่มต้นที่เป็นประโยชน์ |
|---|---|---|
768sq | 768 × 768 พิกเซล | ตัวอย่างสี่เหลี่ยมจัตุรัส |
1k | ประมาณ 1 เมกะพิกเซล | แนวคิดเริ่มต้นและภาพเว็บ |
2k | ประมาณ 4 เมกะพิกเซล | ภาพขนาดใหญ่ขึ้นและการครอบตัดปานกลาง |
4k | ประมาณ 16 เมกะพิกเซล | การส่งมอบที่เน้นรายละเอียดและการครอบตัดขนาดใหญ่ |
โครงสร้าง API ปัจจุบันยังรวมถึง 1.5k; ตรวจสอบบริการที่เลือกสำหรับขนาดและราคาที่มี โมเดลรองรับอัตราส่วนภาพคงที่ 15 แบบ ตั้งแต่กว้างไปจนถึงสูง รวมถึง auto
การเปลี่ยนความละเอียดจะสร้างการสร้างใหม่ ดังนั้นองค์ประกอบอาจเปลี่ยนไป หากคุณต้องการรักษาองค์ประกอบของภาพที่เลือกไว้ ให้เปรียบเทียบการสร้างใหม่แบบเนทีฟกับการ ปรับขนาดภาพที่มีอยู่ จากนั้นตรวจสอบรายละเอียดในทั้งสองอย่าง จำนวนพิกเซลที่สูงขึ้นเพียงอย่างเดียวไม่สามารถแก้ไขป้ายกำกับที่ไม่ถูกต้องหรือมือที่บิดเบี้ยวได้
ที่มา: Black Forest Labs, หน้าผลิตภัณฑ์ FLUX 3 Image, Technical Parameters และเอกสารอ้างอิง API ปัจจุบัน
6. ใช้การค้นหาเว็บและภาพเพื่อเป็นข้อมูลในการสร้าง
BFL API มีตัวเลือก grounding ซึ่งเปิดใช้งานโดยค่าเริ่มต้น ตามเอกสารอ้างอิง API จะอนุญาตให้พรอมต์ได้รับข้อมูลจากการวิจัยภายนอกโดยใช้การค้นหาเว็บและภาพ การตั้งค่าเป็น false จะปิดทั้งสองอย่าง
สิ่งนี้เกี่ยวข้องเมื่อข้อมูลสรุปอ้างถึงสถานที่, วัตถุ หรือหัวข้อในโลกแห่งความเป็นจริงที่จดจำได้ การค้นหาสามารถให้บริบทนอกเหนือจากคำพูดของพรอมต์ อย่างไรก็ตาม เป็นกลไกช่วยเหลือ ไม่ใช่หลักฐานว่าทุกรายละเอียดที่แสดงถูกต้องหรือเป็นปัจจุบัน
สำหรับแนวคิดสมมติ การอ้างอิงที่คุณให้ไว้อาจมีประโยชน์มากกว่าการวิจัยภายนอก สำหรับหัวข้อในโลกแห่งความเป็นจริง ให้ตรวจสอบคุณสมบัติที่จดจำได้และข้อความที่เป็นข้อเท็จจริงในผลลัพธ์ ความแตกต่างนี้ช่วยให้คุณตัดสินใจได้ว่าการอ้างอิงมีประโยชน์สำหรับงานหรือไม่
ที่มา: Black Forest Labs, FLUX 3 Image API reference.
คุณสามารถลองใช้ได้ที่ไหน และมีค่าใช้จ่ายเท่าไร?
FLUX 3 Image มีให้บริการผ่าน Playground และ API ของ Black Forest Labs สำหรับนักพัฒนา จุดสิ้นสุดของภาพคือ /v1/flux-3-image; พรอมต์และภาพที่ให้มาจะกำหนดว่าจะสร้างหรือแก้ไข โดยไม่มีฟิลด์ mode แยกต่างหาก
บันทึกการเผยแพร่และเอกสารราคาของ BFL ระบุราคาพื้นฐานต่อภาพที่ 0.041 ดอลลาร์สำหรับ 768sq, 0.048 ดอลลาร์สำหรับ 1k, 0.100 ดอลลาร์สำหรับ 2k และ 0.607 ดอลลาร์สำหรับ 4k สิ่งเหล่านี้ได้รับการตรวจสอบเมื่อวันที่ 3 ตุลาคม 2026 โปรโมชั่นเปิดตัวและบริการของบุคคลที่สามอาจคิดค่าบริการแตกต่างกัน ดังนั้นให้ใช้ราคาปัจจุบันจากผู้ให้บริการที่คุณเลือก อัตราดอลลาร์เหล่านี้ไม่ใช่ราคาเครดิต Nano Banana
หน้า FLUX 3 ของเรารวบรวมข้อมูลพื้นฐานของโมเดลและการอัปเดตที่เกี่ยวข้อง สำหรับความสามารถที่อธิบายไว้ในที่นี้ ให้เลือกบริการที่เสนอ FLUX 3 Image และการควบคุมที่คุณต้องการอย่างชัดเจน
ใครควรให้ความสนใจกับการเปิดตัวนี้?
FLUX 3 Image คุ้มค่าที่จะสำรวจหากปัญหาคอขวดของคุณคือการควบคุมและแก้ไขภาพ: การจัดองค์ประกอบหลายอย่างเข้าด้วยกัน, การรวมวัสดุอ้างอิง หรือการเปลี่ยนส่วนหนึ่งโดยไม่สูญเสียส่วนที่เหลือ นักออกแบบที่สร้างโปสเตอร์และปก, ทีมที่ผลิตเนื้อหาแคมเปญ และผู้สร้างที่ทำงานกับหัวข้อที่เกิดซ้ำมีกรณีการใช้งานที่ชัดเจนในการประเมิน
สำหรับการประเมินครั้งแรก ให้ดูสามสิ่ง: ว่าเลย์เอาต์เป็นไปตามข้อมูลสรุปของคุณหรือไม่, ว่าการอ้างอิงยังคงรายละเอียดที่คุณสนใจหรือไม่ และว่าการแก้ไขยังคงรักษาสภาพแวดล้อมไว้หรือไม่ การตรวจสอบเหล่านี้ทำให้ความสามารถใหม่ของโมเดลมีความหมายสำหรับงานของคุณเอง

