รีวิว FLUX 3: วิดีโอ, เสียง, ราคา และวิธีการใช้งาน

flux-3-วิดีโอรีวิว

คำตอบด่วน: FLUX 3 เป็นโมเดลพื้นฐานแบบมัลติโมดัลของ Black Forest Labs สำหรับภาพ วิดีโอ เสียง และการคาดการณ์การกระทำ ณ วันที่ 11 สิงหาคม 2026 BFL ได้เปิด FLUX 3 Video ในโหมด Early Access พร้อมคลิปความยาวสูงสุด 20 วินาที เสียงต้นฉบับตามตัวเลือก และราคาต่อวินาทีที่เปิดเผยต่อสาธารณะ GlobalGPT ยังมีเส้นทาง FLUX 3 Video ที่ได้รับการยืนยันแล้ว ในการทดสอบสามรอบของเรา ทุกงานได้เสร็จสิ้นและส่งคืนไฟล์ MP4 ความยาว 5.04 วินาที พร้อมสตรีมเสียง แต่การควบคุมระยะเวลาที่แม่นยำ การจัดระยะห่างของตัวอักษร และความสม่ำเสมอของวัตถุยังไม่สมบูรณ์แบบ.

ข้อความนั้นยังต้องปรับให้เหมาะสมยิ่งขึ้น ส่วน โพสต์ประกาศเปิดตัวอย่างเป็นทางการ และ หน้าแบบอย่างอย่างเป็นทางการ อธิบาย FLUX 3 Video เป็น Early Access ในขณะที่หน้ากำหนดราคาของ BFL ได้เผยแพร่ราคาบริการวิดีโอแล้ว GlobalGPT เปิดเส้นทางแพลตฟอร์มแยกต่างหากที่ขับเคลื่อนโดยโมเดลดังกล่าว การเข้าถึงผ่านเส้นทางดังกล่าวไม่ได้หมายความว่าทุก API ของ BFL ตัวเลือกน้ำหนักส่วนตัว โมเดลภาพ โมเดลการกระทำ หรือ FLUX 3 Dev release จะพร้อมใช้งานทั่วไป.

การอัปเดตครั้งนี้ได้เพิ่มการตรวจสอบแบบปฏิบัติจริงเล็กน้อย: สามรุ่นเมื่อวันที่ 11 สิงหาคม โดยใช้ flux-3-video ID ของโมเดล รวมถึงการซ้ำคำสั่งที่ตรงกันหนึ่งครั้ง ซึ่งเพียงพอที่จะบันทึกพฤติกรรมจริงและจุดที่เกิดความผิดพลาดที่สังเกตได้ แต่ผลลัพธ์สามชุดนี้ยังไม่ถือเป็นเกณฑ์มาตรฐานที่ครอบคลุม.

ภาพรวมการรีวิว

การทดสอบ FLUX 3 Video แบบแรกจากผู้ผลิตเอง 3 ครั้ง — ไม่ใช่การวัดประสิทธิภาพแบบกว้างขวาง.

วิ่งระยะเวลาที่ส่งคืนการแก้ไขปัญหาเสียง
3/3 สำเร็จ5.04 วินาที ต่อคลิป1280 × 704ข้อมูลที่ถอดรหัสแล้วในทุกไฟล์

FLUX 3 คืออะไร?

FLUX 3 เป็นโมเดลพื้นฐานแบบมัลติโมดัลจาก Black Forest Labs ต่างจากระบบที่ได้รับการฝึกฝนเพื่อแปลงข้อความเป็นภาพเท่านั้น BFL ระบุว่าโมเดลนี้เรียนรู้ร่วมกันจากภาพ วิดีโอ และเสียงในสถาปัตยกรรมเดียว เป้าหมายคือการสร้างตัวแทนที่เชื่อมโยงโครงสร้างทางพื้นที่ การเคลื่อนไหว เสียง สาเหตุ และการกระทำ แทนที่จะพิจารณาแต่ละสื่อเป็นคุณสมบัติที่แยกจากกัน.

หน้าหลักของ FLUX 3 ที่แสดงภาพ วิดีโอ เสียง และการคาดการณ์การเคลื่อนไหว
Black Forest Labs นำเสนอ FLUX 3 ซึ่งเป็นโมเดลแบบมัลติโมดัลที่ครอบคลุมการคาดการณ์ภาพ วิดีโอ เสียง และการกระทำ.

ชื่อนี้อาจฟังดูเหมือนเป็นรุ่นต่อมาตามปกติของ FLUX.1 และ FLUX.2 แต่ขอบเขตการใช้งานนั้นกว้างกว่ามาก FLUX.2 ยังคงเป็นชุดโปรแกรมสำหรับการสร้างและแก้ไขภาพในปัจจุบัน; ส่วน คู่มือ FLUX 2 Pro ครอบคลุมกระบวนการทำงานด้านภาพของรุ่นนั้น บริบทด้านราคา และระบบการให้คำสั่ง FLUX 3 ได้รับการวางตำแหน่งให้เป็นโครงสร้างพื้นฐานร่วมกันสำหรับการสร้างเนื้อหาและการคาดการณ์การกระทำ.

BFL ใช้คำว่า “world model” เพื่ออธิบายทิศทางนี้ ในที่นี้ ไม่ได้หมายความว่าบริษัทได้ประกาศเกี่ยวกับปัญญาประดิษฐ์ทั่วไป แต่หมายความว่าโมเดลนี้ถูกออกแบบมาเพื่อเรียนรู้ว่าวัตถุที่มองเห็นได้ การเคลื่อนไหว เสียง และการกระทำ มีความสัมพันธ์กันอย่างไรตามเวลา ความแตกต่างนี้มีความสำคัญ เพราะข้ออ้างที่น่าสนใจที่สุดของ FLUX 3 ไม่ใช่เพียงแค่ “ภาพที่ดีขึ้น” แต่เป็นโมเดลพื้นฐานเดียวที่รองรับการสร้างและควบคุมหลายประเภท.

ทำไม FLUX 3 จึงมากกว่าแค่เครื่องมือสร้างภาพ

ผลิตภัณฑ์ AI ที่สร้างสรรค์ส่วนใหญ่ยังคงถูกใช้งานในฐานะเครื่องมือที่แยกกัน: โมเดลหนึ่งสร้างภาพ โมเดลอีกตัวสร้างวิดีโอ และโมเดลตัวที่สามเพิ่มเสียงพูดหรือเอฟเฟกต์เสียง FLUX 3 ได้รับการออกแบบบนพื้นฐานแนวคิดที่แตกต่างออกไป หากสถาปัตยกรรมเดียวสามารถเรียนรู้รูปแบบข้อมูลเหล่านี้ร่วมกันได้ คำคำสั่ง ภาพอ้างอิง ลำดับการเคลื่อนไหว และเสียงประกอบ ก็อาจมีความเข้าใจภายในที่เหมือนกันได้.

  • ภาพช่วยสร้างพื้นที่: วัตถุ, การจัดวาง, เนื้อสัมผัส, การจัดวางตัวอักษร และความสัมพันธ์ทางภาพ.
  • วิดีโอเพิ่มเวลา: การเคลื่อนไหว ความต่อเนื่อง การติดต่อ และความสัมพันธ์ระหว่างเหตุและผลระหว่างเฟรมต่างๆ.
  • เสียงเพิ่มสัญญาณที่สอดคล้องกันอีกหนึ่งสัญญาณ: เสียงพูด เสียงบรรยากาศ และเสียงต่าง ๆ ที่เกี่ยวข้องกับเหตุการณ์ที่มองเห็นได้.
  • การคาดการณ์การเคลื่อนไหวช่วยเชื่อมโยงการรับรู้กับการควบคุม: การจำลองแบบของโมเดลสามารถปรับให้เหมาะสมเพื่อคาดการณ์ว่าหุ่นยนต์ควรทำอะไรต่อไป.

สำหรับผู้สร้างเนื้อหา ข้อดีในทางปฏิบัติคือมีการส่งต่องานระหว่างขั้นตอนการผลิตน้อยลง เสียงต้นฉบับมีความสำคัญเป็นพิเศษ เพราะสามารถลดช่องว่างระหว่างการสร้างคลิปกับการผลิตเสียงสนทนา เสียงเอฟเฟกต์ และการซิงโครไนซ์อย่างแยกกัน หากเสียงเป็นประเด็นหลักของคุณ ระบบปัจจุบัน Veo คู่มือเสียง 3.1 แสดงให้เห็นว่าครอบครัววิดีโอชั้นนำอีกแห่งหนึ่งกำลังจัดการกับเสียงต้นฉบับอย่างไรในปัจจุบัน.

ภาพรวมคุณสมบัติของ FLUX 3

ความสามารถสิ่งที่ BFL ได้ประกาศสถานะ ณ วันที่ 11 สิงหาคม 2026
วิดีโอ FLUX 3การสร้างและแก้ไขวิดีโอพร้อมตัวเลือกเสียงต้นฉบับ เช่น เสียงพูด เอฟเฟกต์ สไตล์ การจัดรูปแบบตัวอักษร และกระบวนการทำงานแบบหลายช็อตBFL Early Access; ราคาอย่างเป็นทางการได้ประกาศแล้ว; เส้นทาง GlobalGPT ได้รับการยืนยันแล้ว
ภาพ FLUX 3การสร้างและแก้ไขภาพผ่าน API และการเข้าถึงน้ำหนักส่วนตัวประกาศเปิดให้เข้าถึงก่อนกำหนด; บทความนี้ยังไม่ได้ทดสอบ
FLUX 3 Actionการคาดการณ์การเคลื่อนไหวแบบเนทีฟ ร่วมกับโมเดลเฉพาะทางที่สร้างขึ้นจากระบบโครงข่ายวิดีโอเริ่มจากพันธมิตรที่ได้รับการคัดเลือก
FLUX 3 Devโครงข่ายหลักแบบหลายรูปแบบที่ไม่มีข้อจำกัดด้านน้ำหนัก สำหรับการคาดการณ์วิดีโอ เสียง ภาพ และการเคลื่อนไหวได้ประกาศแล้ว; ยังไม่เปิดเผยวันที่และใบอนุญาต

FLUX 3 Video เป็นผลิตภัณฑ์ที่ชัดเจนที่สุดในระยะสั้น BFL ระบุว่าผลิตภัณฑ์นี้รองรับการแปลงข้อความเป็นวิดีโอและการตัดต่อ เสียงที่ซิงโครไนซ์ บทสนทนาหลายภาษา อัตราส่วนภาพที่หลากหลาย การจัดรูปแบบตัวอักษร และคลิปที่เชื่อมต่อกัน คุณสมบัติเหล่านี้ทำให้ผลิตภัณฑ์นี้ต้องแข่งขันในตลาดที่มีผู้แข่งขันเพิ่มขึ้นเรื่อยๆ; การเปรียบเทียบเครื่องมือสร้างวิดีโอ AI ที่ดีที่สุด ให้ข้อมูลบริบทที่มีประโยชน์เกี่ยวกับสิ่งที่ผู้สร้างเนื้อหาสามารถใช้ได้อยู่แล้ว ในขณะที่การเข้าถึง FLUX 3 ยังถูกจำกัด.

โพสต์การเปิดตัวยังอธิบายถึงคลิปวิดีโอความยาว 10 วินาที ความละเอียด 720p ที่สร้างจากข้อความ พร้อมเสียง ในการประเมินเบื้องต้น BFL ระบุอย่างชัดเจนว่าโมเดลและระบบประเมินผลยังอยู่ในขั้นตอนการพัฒนา ซึ่งทำให้ตัวเลขเหล่านี้มีประโยชน์ในฐานะหลักฐานเบื้องต้นที่บริษัทรายงาน แต่ไม่สามารถใช้แทนการทดสอบอย่างอิสระและสามารถทำซ้ำได้ หลังจากที่การเข้าถึงสาธารณะขยายตัว.

หน้าข้อมูลรุ่นปัจจุบันให้ข้อมูลเพิ่มเติมว่า FLUX 3 Video สามารถสร้างวิดีโอได้ยาวสูงสุด 20 วินาทีในครั้งเดียว โดยสามารถเลือกเพิ่มเสียงได้ และสามารถสร้างเสียงพูดหลายภาษา เอฟเฟกต์ และเสียงบรรยากาศไปพร้อมกับเฟรมวิดีโอได้ นี่คือขีดจำกัดความสามารถอย่างเป็นทางการ ส่วนการทดสอบจริงด้านล่างนี้บันทึกผลลัพธ์ที่แพลตฟอร์มที่เชื่อมต่อส่งกลับมาจริง ๆ จากคำสั่งของเรา.

FLUX 3 มีจำหน่ายแล้วหรือไม่?

ใช่ แต่เพียงผ่านระบบ Early Access แบบเป็นขั้นตอนเท่านั้น. BFL ได้เปิดช่องทางรับสมัครแทนที่จะเปิดตัวแบบบริการตนเองอย่างกว้างขวาง ดังนั้น บริษัทจึงสามารถทำงานร่วมกับผู้ใช้และพันธมิตรที่ได้รับการคัดเลือกได้ ในขณะที่โมเดล API ตัวเลือกน้ำหนักส่วนตัว และกระบวนการประเมินผลยังคงอยู่ในขั้นตอนการพัฒนา.

แผนการเปิดตัวอย่างเป็นทางการของ FLUX 3 สำหรับ Video, Image, Action และ Dev
แผนการเปิดตัวของ BFL แบ่ง FLUX 3 Video, Image, Action และ Dev ออกเป็นหลายขั้นตอนสำหรับการปล่อยเวอร์ชันเข้าถึงล่วงหน้า.
คำถามที่รู้จักยังจำกัดหรือไม่ทราบ
คนทั่วไปสามารถสมัครเข้าร่วม BFL ได้หรือไม่?ใช่ครับ ผ่านแบบฟอร์มขออย่างเป็นทางการเกณฑ์การยอมรับและเวลาตอบสนอง
ผู้ใช้สามารถทดลองใช้ FLUX 3 Video บน GlobalGPT ได้หรือไม่?ใช่ครับ; ลิงก์ไปยังขั้นตอนการตรวจสอบผลิตภัณฑ์มีอยู่ด้านล่างนี้ขีดจำกัดและโควตาของเส้นทางขึ้นอยู่กับบัญชีแพลตฟอร์ม
BFL กำหนดราคาต่อสาธารณะอย่างไร?อัตราค่าบริการแปลงข้อความ/ภาพเป็นวิดีโอ, การต่อต่อ, ฉบับร่าง, HD และ FHDเงื่อนไขสำหรับผู้ใช้ส่วนตัวและองค์กร
จะมีประเภทน้ำหนักเปิดหรือไม่?FLUX 3 Dev ได้รับการวางแผนให้เป็นรุ่นน้ำหนักเปิดวันที่ออกจำหน่าย, ใบอนุญาต และข้อกำหนดด้านฮาร์ดแวร์
GlobalGPT FLUX 3 เส้นทางการใช้งานผลิตภัณฑ์วิดีโอที่แสดงวิธีการแปลงข้อความเป็นวิดีโอและภาพเป็นวิดีโอ
เส้นทางผลิตภัณฑ์ GlobalGPT ที่ได้รับการยืนยันแล้ว ระบุ FLUX 3 Video พร้อมคุณสมบัติการแปลงข้อความเป็นวิดีโอ การแปลงภาพเป็นวิดีโอ และการจัดวางเสียงต้นฉบับ.

การตีความที่ปลอดภัยที่สุดนั้นเรียบง่าย: FLUX 3 เป็นจริงและกำลังอยู่ในขั้นตอนการเปิดตัว แต่คำว่า “Early Access” ไม่ควรถูกตีความใหม่เป็น “เปิดให้ทุกคนใช้งานได้” หากท่านต้องการกำหนดเส้นตายสำหรับการผลิต โปรดรอจนกว่าจะได้รับยืนยันการเข้าถึงและเงื่อนไขเป็นลายลักษณ์อักษรก่อนที่จะออกแบบกระบวนการทำงานตามนั้น.

วิดีโอการทดสอบ FLUX 3: สามรอบการทดสอบ ผลลัพธ์จริง

3/3งานที่เสร็จสิ้นแล้ว
5.04 วินาทีคลิปที่ส่งกลับมาแต่ละคลิป
1280 × 704ไฟล์ MP4 แต่ละไฟล์
มีเสียงถูกถอดรหัสในทุกไฟล์

การตั้งค่าการทดสอบ: เราได้ดำเนินการทดสอบเมื่อวันที่ 11 สิงหาคม 2026 ผ่านสภาพแวดล้อมการทดสอบ Broly task ที่เชื่อมต่อกับแพลตฟอร์ม โดยใช้ ID ของโมเดลที่ตรงกัน flux-3-video. แต่ละคำขอประกอบด้วยเพียง ID ของโมเดลและข้อความคำสั่งเท่านั้น เราได้ส่งคำขอสามชุด ได้แก่ ข้อความคำสั่งเกี่ยวกับโฆษณาผลิตภัณฑ์ ข้อความคำสั่งเกี่ยวกับความสอดคล้องตามเวลา และการทำซ้ำข้อความคำสั่งแรกอย่างแม่นยำ API ของงานรายงานเวลาประมวลผลจริงเป็น 88, 190 และ 77 วินาที ตามลำดับ เนื่องจากการรันทำงานพร้อมกันและเส้นทางยังคงอยู่ในขั้นตอนพัฒนา จึงไม่ควรถือว่าเวลาเหล่านี้เป็นเกณฑ์วัดความล่าช้า.

การทดสอบ 1: การจัดรูปแบบตัวอักษร การแปลงรูปแบบ และเสียงต้นฉบับ

รหัสงาน: task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. คำโจทย์ระบุว่าต้องสร้างโฆษณาน้ำหอมความยาว 8 วินาที แบบสองช็อต พร้อมข้อความบนฉลากที่ตรงตามต้นฉบับ การเปลี่ยนรูปจากขวดน้ำหอมเป็นเมือง เสียงคลิกของแก้ว เสียงลมพัดผ่าน และคำพูดหนึ่งประโยค.

ข้อความคำสั่งคำสั่งทดสอบ 1
สร้างโฆษณาผลิตภัณฑ์แบบภาพยนตร์ความยาว 8 วินาที ในอัตราส่วน 16:9 ด้วยสองฉากที่เชื่อมต่อกัน ฉากที่ 1: บนโต๊ะสตูดิโอที่มืด ขวดน้ำหอมสีฟ้าโคบอลต์แบบโปร่งแสงหมุนช้าๆ ใต้แสงสปอตไลท์สีขาวที่แคบ; ฉลากด้านหน้าต้องแสดงข้อความ 'FLUX 3' อย่างชัดเจนด้วยตัวอักษรสีขาวแบบ sans-serif ที่เรียบง่าย โดยไม่มีข้อความอื่นใด ช็อตที่ 2: ขวดน้ำหอมเปิดออกเป็นริบบิ้นแสงสีฟ้าที่ค่อยๆ เปลี่ยนเป็นเส้นขอบฟ้าของเมืองในยามค่ำคืน ขณะที่ขวดน้ำหอมเดิมยังคงอยู่ตรงกลางและสามารถระบุได้ชัดเจน ใช้การเคลื่อนไหวของกล้องที่นุ่มนวลและคุณภาพสูง การสะท้อนแสงบนแก้วที่สมจริง และเสียงที่ประสานกัน: เสียงคลิกเบาๆ ของแก้วเมื่อเปิดฝา เสียงวูชอิเล็กทรอนิกส์ที่ค่อยๆ ดังขึ้นระหว่างการเปลี่ยนรูป และเสียงพูดที่สงบที่กล่าวอย่างชัดเจนว่า 'Make the moment move.' ห้ามเพิ่มคำบรรยาย โลโก้ น้ำประทับ หรือข้อความเพิ่มเติมใดๆ.

เลือกข้อความคำสั่งด้วยตนเอง หากการตั้งค่า WordPress ของคุณปิดใช้งานการควบคุมการคัดลอก.

FLUX 3 การทดสอบแบบปฏิบัติจริง 1: วิดีโอโฆษณาผลิตภัณฑ์ที่ถูกส่งคืน.
ภาพ 5 ภาพที่เลือกมาจากการทดสอบแบบอักษรและเสียงของ FLUX 3
ภาพ 5 เฟรมแสดงฉลาก การหมุนขวด การเปลี่ยนสีเป็นแสงสีฟ้า และการเผยให้เห็นเมือง.

เกิดอะไรขึ้น: ผลลัพธ์ที่ได้สร้างเส้นโค้งภาพตามที่ต้องการ และรักษาแนวคิดน้ำหอมสีฟ้าให้อ่านได้ชัดเจนในทั้งสองฉาก ป้ายยังคงอ่านได้ชัดเจน แต่ในเชิงภาพได้บีบพื้นที่ตามที่ต้องการให้แคบลง และดูคล้ายกับ “FLUX3” มากกว่า “FLUX 3” ที่ถูกต้อง ขวดยังเปลี่ยนรูปทรงของฝาและตัวขวดระหว่างการแปลงด้วย ไฟล์ MP4 มีข้อมูลเสียงที่ถูกถอดรหัสแล้ว แต่ระบบตรวจสอบอัตโนมัติของเราไม่ได้ถอดความคำพูดที่กล่าวออกมา ดังนั้นเราจึงไม่ประเมินบทสนทนาตามคำต่อคำ สิ่งสำคัญที่สุดคือคลิปที่ส่งกลับมา มีความยาว 5.04 วินาที แทนที่จะเป็น 8 วินาทีตามที่ร้องขอ.

การทดสอบ 2: ความสม่ำเสมอของภาพเคลื่อนไหวและวัตถุในภาพเดียว

รหัสงาน: task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. คำสั่งนี้ได้ตัดการเปลี่ยนฉากออกไป และขอให้หุ่นยนต์แบบไขลานหนึ่งตัวผ่านจุดหมายสามจุดตามลำดับที่กำหนดไว้ โดยยังคงรักษาลักษณะเฉพาะตัวของมันไว้.

ข้อความคำสั่งคำสั่งทดสอบ 2
สร้างฉากถ่ายต่อเนื่องแบบเดียว (single continuous tracking shot) ความยาว 8 วินาที ในอัตราส่วน 16:9 โดยไม่มีการตัดต่อ หุ่นยนต์สีแดงขนาดเล็กแบบไขลาน ที่มีหัวรูปสี่เหลี่ยม ดวงตาสีเงินกลมสองดวง กุญแจทองเหลืองหนึ่งอันที่หลัง และรองเท้าสีขาว เดินจากซ้ายไปขวาผ่านเครื่องหมายบนพื้นสามจุดตามลำดับนี้อย่างแม่นยำ: สีเหลือง สีฟ้า แล้วสีเขียว กล้องจะติดตามที่ระดับเอว ในขณะที่หุ่นยนต์รักษารูปทรงร่างกาย สีสัน จำนวนตา กุญแจหลัง และทิศทางการเดินให้คงที่ตลอดทั้งฉาก เพิ่มเสียงก้าวเท้าโลหะที่สอดคล้องกับภาพ และเสียงบรรยากาศห้องที่เงียบสงบ ไม่มีบทพูด ไม่มีข้อความ ไม่มีตัวละครเพิ่มเติม ไม่มีการตัดต่อกล้อง และไม่มีการเปลี่ยนชุด.

เลือกข้อความคำสั่งด้วยตนเอง หากการตั้งค่า WordPress ของคุณปิดใช้งานการควบคุมการคัดลอก.

FLUX 3 การทดสอบเชิงปฏิบัติ ครั้งที่ 2: วิดีโอหุ่นยนต์แบบถ่ายครั้งเดียวที่ส่งกลับมา.
ภาพ 5 ภาพที่เลือกมาจากการทดสอบความสอดคล้องทางเวลาของ FLUX 3
หุ่นยนต์เคลื่อนที่จากซ้ายไปขวาผ่านสีเหลือง สีฟ้า และสีเขียว โดยยังคงรักษาตัวสีแดง ตาทั้งสองข้าง รองเท้าสีขาว และปุ่มด้านหลังไว้.

เกิดอะไรขึ้น: นี่คือผลลัพธ์ที่ชัดเจนกว่า หุ่นยนต์เคลื่อนที่ไปตามทิศทางที่ร้องขอ และผ่านจุดมาร์กเกอร์สีเหลือง สีฟ้า และสีเขียวตามลำดับ รายละเอียดหลักที่ใช้ระบุตัวตนยังคงมองเห็นได้ตลอดทั้งคลิป โดยไม่มีตัวละครเพิ่มเติมหรือการตัดต่อกล้องที่ชัดเจน การเคลื่อนไหวดูเรียบง่ายมากกว่าที่จะมีลักษณะแบบภาพยนตร์ แต่ความเรียบง่ายนี้ทำให้การประเมินความสม่ำเสมอทำได้ง่ายขึ้น ผลลัพธ์ครั้งนี้มีระยะเวลา 5.04 วินาที และประกอบด้วยข้อมูลเสียงที่ถอดรหัสแล้ว.

การทดสอบที่ 3: การทำซ้ำแบบตรงตามคำสั่งแรก

รหัสงาน: task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. เราได้ส่งข้อความเริ่มต้นครั้งแรกอีกครั้งโดยไม่เปลี่ยนแปลงคำใดเลย.

ข้อความคำสั่งแสดงข้อความซ้ำ
สร้างโฆษณาผลิตภัณฑ์แบบภาพยนตร์ความยาว 8 วินาที ในอัตราส่วน 16:9 ด้วยสองฉากที่เชื่อมต่อกัน ฉากที่ 1: บนโต๊ะสตูดิโอที่มืด ขวดน้ำหอมสีฟ้าโคบอลต์แบบโปร่งแสงหมุนช้าๆ ใต้แสงสปอตไลท์สีขาวที่แคบ; ฉลากด้านหน้าต้องแสดงข้อความ 'FLUX 3' อย่างชัดเจนด้วยตัวอักษรสีขาวแบบ sans-serif ที่เรียบง่าย โดยไม่มีข้อความอื่นใด ช็อตที่ 2: ขวดน้ำหอมเปิดออกเป็นริบบิ้นแสงสีฟ้าที่ค่อยๆ เปลี่ยนเป็นเส้นขอบฟ้าของเมืองในยามค่ำคืน ขณะที่ขวดน้ำหอมเดิมยังคงอยู่ตรงกลางและสามารถระบุได้ชัดเจน ใช้การเคลื่อนไหวของกล้องที่นุ่มนวลและคุณภาพสูง การสะท้อนแสงบนแก้วที่สมจริง และเสียงที่ประสานกัน: เสียงคลิกเบาๆ ของแก้วเมื่อเปิดฝา เสียงวูชอิเล็กทรอนิกส์ที่ค่อยๆ ดังขึ้นระหว่างการเปลี่ยนรูป และเสียงพูดที่สงบที่กล่าวอย่างชัดเจนว่า 'Make the moment move.' ห้ามเพิ่มคำบรรยาย โลโก้ น้ำประทับ หรือข้อความเพิ่มเติมใดๆ.

เลือกข้อความคำสั่งด้วยตนเอง หากการตั้งค่า WordPress ของคุณปิดใช้งานการควบคุมการคัดลอก.

ภาพตัวอย่าง 5 ภาพจากโฆษณาผลิตภัณฑ์ที่แสดงซ้ำใน FLUX 3
การให้คำสั่งซ้ำๆ ได้ผลลัพธ์เป็นเรื่องราวระดับสูงที่เหมือนกัน แต่มีการออกแบบขวด ฝา เส้นทางการถ่ายภาพ และการเปิดเผยเมืองที่แตกต่างกัน.

เกิดอะไรขึ้น: การซ้ำนี้รักษาแนวคิดไว้มากกว่าผลลัพธ์ที่เหมือนกันทุกประการ มันสร้างขวดสีน้ำเงิน ตัวอักษร “FLUX3” ที่อ่านได้ แถบแสง และเส้นขอบฟ้าในยามค่ำคืนขึ้นมาอีกครั้ง แต่รูปทรงของขวด ฝาขวด กรอบภาพ และการเปลี่ยนผ่านนั้นแตกต่างกัน สิ่งนี้ถือเป็นเรื่องปกติสำหรับรุ่นที่ไม่ได้กำหนดค่าเริ่มต้น แต่จะกลายเป็นปัญหาเมื่อทีมแบรนด์คาดหวังรายละเอียดผลิตภัณฑ์ที่สามารถทำซ้ำได้.

มิติการทดสอบผลการสังเกตข้อสรุปที่สามารถนำไปใช้ได้จริง
การเสร็จสิ้นงาน3 จาก 3 งานสำเร็จแล้วเส้นทางที่เชื่อมต่อนี้ทำงานได้ปกติระหว่างการทดสอบครั้งนี้
การควบคุมระยะเวลาคำสั่งทั้งสามต่างกำหนดเวลา 8 วินาที; แต่ผลลัพธ์ทั้งหมดได้ 5.04 วินาทีตรวจสอบการควบคุมระยะเวลาในระดับเส้นทางก่อนเข้าสู่ระบบผลิต
การจัดรูปแบบตัวอักษรฉลากอ่านได้ แต่ระยะห่างที่แม่นยำของ “FLUX 3” ไม่ได้รับการรักษาไว้วางแผนสำหรับการลองใหม่หรือขั้นตอนหลังการผลิตสำหรับข้อความของแบรนด์
ความสอดคล้องตามเวลาหุ่นยนต์แบบเรียบง่ายนี้ยังคงรักษาลักษณะเด่นและลำดับของมาร์กเกอร์ไว้คำสั่งแบบครั้งเดียวที่มีข้อจำกัดสามารถทำงานได้ดี
ความซ้ำได้เรื่องราวเดิม แต่รูปทรงผลิตภัณฑ์และตัวเลือกกล้องต่างกันการซ้ำคำสั่งอย่างแม่นยำไม่ได้หมายความว่าจะซ้ำภาพอย่างแม่นยำ
เสียงไฟล์ MP4 ทุกไฟล์ล้วนมีข้อมูลเสียงที่ผ่านการถอดรหัสแล้ว; แต่บทสนทนาไม่ได้ถูกแปลงเป็นข้อความโดยอัตโนมัติฟังและตรวจสอบการซิงค์ด้วยตนเองก่อนอนุมัติ

ความเห็นของเรา: วิดีโอ FLUX 3 ติดตามตรรกะของฉากในระดับสูงได้ดีกว่าการยึดติดกับข้อจำกัดในการผลิตอย่างเคร่งครัด การแปลงผลิตภัณฑ์ที่ราบรื่นและการเคลื่อนไหวของหุ่นยนต์ที่เป็นระเบียบเป็นสิ่งที่น่าชื่นชม เวลาการกลับที่คงที่ 5.04 วินาที การจัดระยะห่างของข้อความที่ไม่สมบูรณ์ และการเบี่ยงเบนของรูปทรงขวด เป็นเหตุผลที่คุณควรทดสอบขั้นตอนการทำงานของคุณเองก่อนที่จะนำไปใช้จริง นี่เป็นสัญญาณปฏิบัติที่มีประโยชน์ ไม่ใช่คะแนนที่ครอบคลุมทั้งโมเดล.

FLUX 3 vs FLUX.2: มีอะไรที่เปลี่ยนแปลงไปบ้าง?

พื้นที่ฟลักซ์.2FLUX 3
อัตลักษณ์สาธารณะหลักกลุ่มเครื่องมือสร้างและแก้ไขภาพโมเดลพื้นฐานแบบหลายรูปแบบ
รูปแบบภาพและขั้นตอนการทำงานในการแก้ไขภาพภาพ, วิดีโอ, เสียง และการคาดการณ์การกระทำ
สิทธิ์การเข้าถึงปัจจุบันแบบจำลอง API ที่เผยแพร่และราคาสิทธิ์เข้าถึงวิดีโอ BFL ก่อนใคร, ราคาวิดีโออย่างเป็นทางการ และเส้นทาง GlobalGPT ที่ได้รับการยืนยัน
ทิศทางของแบบจำลองแบบเปิดหลายตัวแปรของ FLUX.2 และจุดสิ้นสุดที่ได้รับการบันทึกไว้FLUX 3 Dev ประกาศน้ำหนักแบบเปิดแล้ว รายละเอียดจะตามมาในภายหลัง
คำตัดสินที่ยุติธรรมเกี่ยวกับผลการแสดงสามารถทดสอบได้ในฐานะโมเดลภาพได้ตั้งแต่วันนี้วิดีโอสามารถตรวจสอบได้ แต่การลงข้อสรุปอย่างกว้างขวางสำหรับทั้งครอบครัวนั้นยังเร็วเกินไป

การเปลี่ยนแปลงที่ใหญ่ที่สุดคือขอบเขต ไม่ใช่การปรับปรุงที่ได้รับการยืนยันด้วยเปอร์เซ็นต์ FLUX 3 ไม่ใช่เพียง FLUX.2 ที่มาพร้อมคะแนนคุณภาพภาพใหม่ แต่มีวัตถุประสงค์เพื่อรวมการสร้างเนื้อหาเชิงสร้างสรรค์และการกระทำทางกายภาพไว้ในตระกูลเดียวกัน สำหรับการตัดสินใจที่ใช้ภาพเพียงอย่างเดียวในปัจจุบันนั้น, การเปรียบเทียบ FLUX 2 กับ Nano Banana Pro มีประโยชน์ในการนำไปปฏิบัติได้มากกว่า เพราะปัจจุบันทั้งสองด้านสามารถถูกประเมินได้ในฐานะเครื่องมือสร้างภาพ.

การเปรียบเทียบ FLUX 3 กับ FLUX.2 อย่างครบถ้วน ยังจำเป็นต้องมีคำสั่งสร้างภาพที่ตรงกัน การแก้ไขภาพอ้างอิง รูปแบบตัวอักษร การปฏิบัติตามคำสั่ง ความล่าช้า และค่าใช้จ่าย การตรวจสอบวิดีโอสามรอบข้างต้นช่วยลดช่องว่างของหลักฐานลง และ BFL ได้เริ่มเผยแพร่ข้อมูลอัตราค่าบริการวิดีโอของ FLUX 3 แล้ว แต่ยังไม่มีการเปรียบเทียบโมเดลภาพหรือเวอร์ชัน open-weight.

สิ่งที่ผลการสาธิตอย่างเป็นทางการและผลการแข่งขันหุ่นยนต์แสดงให้เห็น

วัสดุเปิดตัวของ BFL แสดงวิดีโอที่สร้างขึ้น เสียงที่ซิงโครไนซ์ สไตล์ภาพ ข้อความเคลื่อนไหว และพฤติกรรมการตัดต่อในขั้นต้น วัสดุเหล่านี้แสดงทิศทางของผลิตภัณฑ์และประเภทผลลัพธ์ที่บริษัทกำลังมุ่งเป้า เนื่องจากเป็นตัวอย่างอย่างเป็นทางการที่ได้รับการคัดเลือก จึงไม่สามารถบอกได้ว่าผู้ใช้ทั่วไปจะสามารถสร้างผลลัพธ์ที่มีคุณภาพเดียวกันได้บ่อยเพียงใด ระยะเวลาการสร้างผลลัพธ์ใช้เวลานานเท่าใด หรือค่าใช้จ่ายสำหรับผลลัพธ์แต่ละชิ้นจะเป็นเท่าใด.

ตารางเปรียบเทียบชุดเครื่องมือสำหรับแบบจำลองร่างกายนุ่มที่เลียนแบบ FLUX
ในตารางการประกอบตัวเครื่องแบบตัวนุ่มของ BFL, FLUX-mimic แสดงอัตราความสำเร็จมัธยฐานที่ 95% จากการทดลองแบบอัตโนมัติ 20 ครั้ง.

งานด้านหุ่นยนต์นั้นมีความเฉพาะเจาะจงมากขึ้น ใน FLUX 3 x รายงานการเลียนแบบ, BFL และ mimic robotics อธิบายการปรับใช้ระบบโครงข่ายวิดีโอ FLUX 3 เพื่อคาดการณ์การเคลื่อนไหวของหุ่นยนต์ แผนภูมิการจัดกลุ่มแบบ soft-body ที่แสดงไว้รายงานว่า FLUX-mimic มีอัตราความสำเร็จมัธยฐานอยู่ที่ 95% โดยแต่ละค่ามัธยฐานที่แสดงด้วยเส้นประนั้นอิงจาก 20 ครั้งการทดลองแบบอัตโนมัติ.

นั่นเป็นผลลัพธ์จากด้านหุ่นยนต์ ไม่ใช่เกณฑ์วัดคุณภาพภาพหรือวิดีโอ ความสำคัญของมันอยู่ที่ระดับแนวคิด: BFL ให้เหตุผลว่าโครงข่ายหลัก (backbone) ที่ได้รับการฝึกให้สร้างแบบจำลองการเคลื่อนไหว การสัมผัส น้ำหนัก และสาเหตุ สามารถเปิดเผยรูปแบบการแทนที่ (representations) ที่มีประโยชน์สำหรับงานทางกายภาพได้ ส่วนว่าวิธีการเดียวกันนี้จะสามารถนำไปประยุกต์ใช้ได้อย่างกว้างขวางกับหุ่นยนต์ โรงงาน และงานต่าง ๆ หรือไม่ ยังจำเป็นต้องมีหลักฐานอิสระที่กว้างขวางยิ่งขึ้น.

ปฏิกิริยาเบื้องต้นของชุมชนบน X และ Reddit

FLUX 3 ได้รับความสนใจทันที ในภาพถ่ายยืนยันเมื่อวันที่ 27 กรกฎาคม, ประกาศอย่างเป็นทางการจาก BFL บน X มี 6,088 ครั้งที่กดถูกใจ 862 ครั้งที่แชร์ต่อ 365 ครั้งที่อ้างอิง และ 314 ครั้งที่ตอบกลับ ตัวเลขเหล่านี้วัดความสนใจในช่วงเปิดตัว ไม่ใช่ความน่าเชื่อถือของรุ่น และตัวเลขเหล่านี้จะยังคงเปลี่ยนแปลงต่อไป.

โพสต์ของ Black Forest Labs X ที่ประกาศการเปิดให้เข้าถึง FLUX 3 ใน giaiบ Early Access
ในโพสต์ประกาศเปิดตัวของ BFL ได้อธิบาย FLUX 3 ว่าเป็นโมเดลแบบรวมสำหรับการคาดการณ์ภาพ วิดีโอ เสียง และการกระทำ.

A โพสต์บน Reddit ใน r/StableDiffusion โพสต์ที่มีหัวข้อว่า “Flux 3 ดูน่าทึ่งมาก นี่เป็นคำสั่งเพียง 1 คำสั่ง” ได้รับ 370 เสียงสนับสนุนและ 63 ความคิดเห็นในหน้าต่างการตรวจสอบเดียวกัน ตัวอย่างหน้าจอแบ่งครึ่งในโพสต์นี้ใช้คำสั่งที่ซับซ้อน แต่ยังคงเป็นตัวอย่างที่แชร์เพียงหนึ่งตัวอย่างเท่านั้น ไม่ใช่การทดสอบมาตรฐานที่ควบคุมได้.

ตัวอย่างโพสต์วิดีโอหน้าจอแบ่ง 3 ส่วนบน Reddit FLUX
ผู้ใช้ Reddit หนึ่งคนได้แชร์คำสั่ง FLUX 3 แบบหน้าจอแบ่งสองส่วนที่ค่อนข้างท้าทาย; โพสต์ดังกล่าวได้รับความคิดเห็น 63 ข้อความและหัวข้อที่เต็มไปด้วยความกระตือรือร้น.

ข้อสรุปที่ถูกต้องคือ ผู้สร้างเนื้อหาสนใจเรื่องความซับซ้อนของคำสั่ง การเคลื่อนไหว เสียงต้นฉบับ และความสม่ำเสมอทางภาพ เมื่อการเข้าถึงขยายตัว การสามารถสร้างผลลัพธ์จากคำสั่งเดิมได้ควรกลายเป็นเกณฑ์การทดสอบหลัก ส่วนในระหว่างนี้, สูตรคำสั่ง Kling 3.0 เป็นแหล่งอ้างอิงที่มีประโยชน์สำหรับการจัดโครงสร้างฉาก พฤติกรรมของกล้อง การเคลื่อนไหว และข้อจำกัดในเครื่องมือวิดีโอที่มีให้ใช้งานได้ในปัจจุบัน.

FLUX 3 API, ราคา และ Open Weights

นับถึงวันที่ 11 สิงหาคม BFL’s เอกสารกำหนดราคาที่เผยแพร่แล้ว รวมถึง FLUX 3 Video. 1 เครดิต เท่ากับ $0.01. การแปลงข้อความเป็นวิดีโอและภาพเป็นวิดีโอมีค่าใช้จ่าย $0.17 ต่อวินาทีในความละเอียด HD หรือ $0.29 ต่อวินาทีในความละเอียด FHD ส่วนร่างวิดีโอ HD มีค่าใช้จ่าย $0.06 ต่อวินาที ค่าใช้จ่ายในการต่อวิดีโออยู่ที่ $0.43 ต่อวินาทีสำหรับ HD หรือ $0.54 ต่อวินาทีสำหรับ FHD ส่วนร่างวิดีโออยู่ที่ $0.12 ต่อวินาที.

รายการได้เผยแพร่หรือได้รับการยืนยันแล้วยังจำกัดหรือไม่ทราบ
ราคาวิดีโอ FLUX 3T2V/I2V: $0.17/s HD, $0.29/s FHD; เวอร์ชันร่าง: $0.06/s. ต่อ: $0.43/s HD, $0.54/s FHD; ร่าง: $0.12/sเงื่อนไขสำหรับผู้ใช้ส่วนตัวและองค์กร
สิทธิ์การเข้าถึง BFLวิดีโอ Early Access, ภาพรวมของโมเดล และราคาได้เปิดเผยต่อสาธารณะแล้วการยอมรับ API ทั่วไป, ขีดจำกัดการใช้ และขีดจำกัดเฉพาะบัญชี
การเข้าถึง GlobalGPTตรวจสอบเส้นทางผลิตภัณฑ์วิดีโอ FLUX 3 และทดสอบภารกิจสามรอบที่สำเร็จขีดจำกัดบัญชีและมาตรการควบคุมระดับเส้นทางอาจแตกต่างจากบริการที่ BFL ให้โดยตรง
FLUX 3 Devได้รับการออกแบบให้เป็นโครงข่ายหลักแบบหลายรูปแบบที่ไม่มีข้อจำกัดด้านน้ำหนักวันที่ออกจำหน่าย, ใบอนุญาต, ขนาดพารามิเตอร์ และความต้องการด้านฮาร์ดแวร์

อย่าถือว่า “open weight” เป็นสิ่งเดียวกันกับ “open source” เพราะน้ำหนัก โค้ด ข้อมูลฝึกอบรม และใบอนุญาต อาจมีเงื่อนไขการเข้าถึงที่แตกต่างกันได้ ดังนั้น การตัดสินที่มีความหมายเกี่ยวกับ “open weight” ต้องรอจนกว่า BFL จะเผยแพร่เวอร์ชัน FLUX 3 Dev ที่จริงและใบอนุญาตอย่างเป็นทางการ.

วิธีขอสิทธิ์เข้าถึง FLUX 3 ก่อนวันเปิดตัวอย่างเป็นทางการ

  1. เปิด หน้าแบบ FLUX 3 อย่างเป็นทางการ และตรวจสอบป้ายระบุความสามารถปัจจุบัน.
  2. คลิกปุ่ม "ตามคำขอ" เพื่อไปยัง แบบฟอร์ม FLUX 3 Early Access อย่างเป็นทางการ.
  3. โปรดอธิบายความสามารถที่คุณต้องการ — วิดีโอ, ภาพ, การดำเนินการ, น้ำหนักส่วนตัว หรือสิทธิ์การเข้าถึงสำหรับนักพัฒนา — และกระบวนการทำงานที่คุณต้องการสร้าง.
  4. โปรดระบุตัวอย่างการใช้งานที่สมจริง ปริมาณที่คาดการณ์ รายละเอียดขององค์กร และเหตุผลที่การเข้าถึงล่วงหน้ามีความสำคัญต่อโครงการ.
  5. โปรดรอการยืนยันเป็นลายลักษณ์อักษรก่อนที่จะสันนิษฐานเกี่ยวกับสิทธิ์การเข้าถึง ราคา ขีดจำกัด หรือวันที่ส่งมอบ.

การเสนอโครงการที่ชัดเจนและเจาะจงจะมีความน่าเชื่อถือมากกว่าการกล่าวแบบทั่วไปว่า “ผมอยากลองทำดู” ตัวอย่างเช่น สตูดิโออาจอธิบายว่าต้องการบทสนทนาหลายภาษาและเอฟเฟกต์ที่ซิงโครไนซ์สำหรับคลิปสั้นของแบรนด์ ส่วนทีมหุ่นยนต์อาจอธิบายเกี่ยวกับงานการควบคุม หุ่นยนต์ที่ใช้ ข้อมูล และสภาพแวดล้อมการนำไปใช้งาน.

หากเป้าหมายคือการสร้างบทสนทนา ให้วางแผนกระบวนการทั้งหมด แทนที่จะวางแผนเพียงคำสั่งการสร้างเท่านั้น Veo 3.1 กระบวนการทำงานของบทสนทนาและการซิงค์ริมฝีปาก เน้นย้ำประเด็นทางปฏิบัติต่าง ๆ — เช่น เวลาพูดของนักพูด ความสม่ำเสมอของเสียง การออกแบบช็อต และการสร้างภาพใหม่ — ซึ่งจะเป็นปัจจัยสำคัญในการประเมิน FLUX 3 Video ด้วย.

ใครควรดู FLUX 3?

  • ผู้สร้างวิดีโอด้วย AI ควรให้ความสำคัญกับเสียงต้นฉบับ บทสนทนาหลายภาษา การตัดต่อ การต่อฉากหลายช็อต ความสม่ำเสมอ ความเร็ว และราคาสุดท้าย.
  • ผู้สร้างภาพ ควรรอผลการเปรียบเทียบที่สามารถทำซ้ำได้ ซึ่งครอบคลุมด้านการปฏิบัติตามคำแนะนำทันที การแก้ไขข้อความอ้างอิง การจัดรูปแบบตัวอักษร และค่าใช้จ่าย จนกว่าจะถึงตอนนั้น, โปรแกรมสร้างภาพด้วย AI ที่ดีที่สุดที่ได้รับการทดสอบในปี 2026 คือรายชื่อที่ผ่านการคัดเลือกแล้วซึ่งมีความเหมาะสมใช้งานได้จริงมากกว่า.
  • นักพัฒนา ควรติดตาม ID ของโมเดลสาธารณะ, ข้อจำกัดการเรียกใช้, การสนับสนุน SDK, เงื่อนไขเกี่ยวกับน้ำหนักส่วนตัว และใบอนุญาตของ FLUX 3 Dev ในอนาคต.
  • ทีมหุ่นยนต์และทีม AI ทางกายภาพ ควรตรวจสอบว่าวิธีการ FLUX-mimic สามารถนำไปใช้กับงานอื่นนอกเหนือจากงานที่ได้รับการเผยแพร่แล้วหรือไม่ และจำเป็นต้องปรับข้อมูลให้เหมาะสมกับงานนั้นมากเพียงใด.

ก่อนที่จะนำกระบวนการทำงานในระบบผลิตไปใช้จริง ให้ใช้การตรวจสอบความพร้อมของ FLUX 3 แบบ 4 ขั้นตอน โดยการสาธิตการเปิดตัวสามารถผ่านขั้นตอนการตรวจสอบความสามารถได้ โดยไม่ต้องผ่านการตรวจสอบด้านสิทธิ์การเข้าถึง ด้านเศรษฐกิจ หรือหลักฐาน.

ประตูสิ่งที่ต้องเป็นความจริงหลักฐานที่จำเป็นต้องรวบรวม
การเข้าถึงทีมของคุณมีเอกสารอนุมัติเกี่ยวกับความสามารถที่จำเป็นคำเชิญเปิดบัญชี, ข้อกำหนด, พื้นที่ให้บริการ, ขีดจำกัด และข้อมูลติดต่อฝ่ายสนับสนุน
ความสามารถโมเดลนี้จะช่วยคุณทำงานจริง ไม่ใช่แค่คำสั่งเพื่อแสดงตัวอย่างเท่านั้นคำสั่งที่ตรงกัน ข้อมูลอ้างอิง กรณีที่ล้มเหลว และการรันซ้ำ
เศรษฐศาสตร์ค่าใช้จ่ายและระยะเวลาดำเนินการสอดคล้องกับแผนการผลิตราคา, เวลาสร้าง, อัตราการลองใหม่, ขีดจำกัดปริมาณ และโครงสร้างพื้นฐาน
หลักฐานผลลัพธ์ยังคงน่าเชื่อถือแม้เมื่อพิจารณาตัวอย่างการเปิดตัวที่ไม่ได้ถูกคัดเลือกการทดสอบแบบอิสระ การตั้งค่าที่สามารถทำซ้ำได้ และผลลัพธ์ที่มีเวอร์ชัน

อยากลองใช้แบบจำลองที่ใช้ในการทดสอบของเราไหม? เปิด วิดีโอ FLUX 3 บน GlobalGPT. เส้นทางการผลิตได้เปิดใช้งานแล้ว และสภาพแวดล้อมงานที่เชื่อมต่อได้เสร็จสิ้นการรันทั้งสามรอบเมื่อวันที่ 11 สิงหาคม 2026 โปรดตรวจสอบการควบคุมและโควตาที่แสดงในบัญชีของคุณก่อนที่จะเริ่มชุดการผลิต.

คำถามที่มักถูกถามเกี่ยวกับ FLUX 3

FLUX 3 ได้รับการประกาศเมื่อไหร่?

Black Forest Labs ได้ประกาศเปิดตัว FLUX 3 เมื่อวันที่ 23 กรกฎาคม 2569 โพสต์การเปิดตัวได้แนะนำโมเดลพื้นฐานแบบมัลติโมดัลที่ครอบคลุมภาพ วิดีโอ เสียง และการคาดการณ์การกระทำ โดยจะเปิดตัวความสามารถของโมเดลนี้ผ่านระบบ Early Access แบบเป็นขั้นตอน แทนที่จะปล่อยให้สาธารณชนทั่วไปใช้งานพร้อมกันในครั้งเดียว.

FLUX 3 มีให้ใช้สาธารณะแล้วหรือไม่?

BFL เปิดให้บริการ FLUX 3 Video ผ่าน Early Access และได้ประกาศราคาบริการวิดีโอแล้ว GlobalGPT ก็มีเส้นทางผลิตภัณฑ์ FLUX 3 Video ที่ได้รับการยืนยันแล้ว อย่างไรก็ตาม สิ่งนี้ไม่ได้หมายความว่า FLUX 3 Image, Action, private weights หรือ FLUX 3 Dev จะสามารถใช้งานแบบบริการตนเองได้อย่างกว้างขวาง; แต่ละฟังก์ชันยังคงมีขั้นตอนการเปิดตัวและเงื่อนไขการใช้งานเป็นของตัวเอง.

FLUX 3 สามารถสร้างวิดีโอที่มีเสียงต้นฉบับได้หรือไม่?

ใช่ BFL ระบุว่า FLUX 3 Video สามารถสร้างเสียงพูดหลายภาษา เอฟเฟกต์ และเสียงบรรยากาศได้พร้อมกับเฟรม ทั้งสามไฟล์ MP4 ในการทดสอบเมื่อวันที่ 11 สิงหาคมของเราล้วนมีข้อมูลเสียงที่ถอดรหัสแล้ว เราไม่ได้ถอดความแทร็กเสียงโดยอัตโนมัติ ดังนั้นการทดสอบนี้จึงยืนยันถึงการมีอยู่ของเสียงมากกว่าการถอดความบทสนทนาให้ตรงตามคำทุกคำ.

FLUX 3 ก็เป็นโมเดลภาพด้วยหรือไม่?

ใช่ครับ การสร้างและแก้ไขภาพเป็นส่วนหนึ่งของตระกูล FLUX 3 แต่ BFL ระบุว่า FLUX 3 Image Early Access จะเปิดให้บริการภายในไม่กี่สัปดาห์หลังการประกาศครั้งแรก ชื่อจุดปลายทางสาธารณะ วันที่เปิดให้บริการอย่างเป็นทางการ และราคา ยังไม่ได้รับการเปิดเผย ณ เวลาที่อัปเดตนี้.

FLUX 3 เป็นซอฟต์แวร์โอเพนซอร์สหรือโอเพนเวท?

BFL ได้ประกาศว่าจะเปิดให้เข้าถึงแบบ open-weight ในอนาคตผ่าน FLUX 3 Dev แต่ยังไม่ได้เปิดเผยวันที่ปล่อยตัว ใบอนุญาต ขนาดพารามิเตอร์ ขอบเขตของโค้ด หรือข้อกำหนดด้านฮาร์ดแวร์ จนกว่ารายละเอียดดังกล่าวจะได้รับการเปิดเผย จึงจะถูกต้องกว่าหากใช้คำว่า “open weight ที่วางแผนไว้” แทนที่จะใช้คำว่า “open source”

FLUX 3 แตกต่างจาก FLUX.2 อย่างไร?

FLUX.2 เป็นชุดเครื่องมือหลักสำหรับการสร้างและแก้ไขภาพในปัจจุบัน ซึ่งมีจุดสิ้นสุด (endpoints) และราคาที่เปิดเผยแล้ว ส่วน FLUX 3 เป็นแพลตฟอร์มพื้นฐานแบบมัลติโมดัลที่มีขอบเขตกว้างขึ้น ซึ่งออกแบบมาเพื่อเชื่อมต่อภาพ วิดีโอ เสียง และการคาดการณ์การกระทำ การเปรียบเทียบคุณภาพหรือราคาอย่างยุติธรรมต้องรอจนกว่า FLUX 3 จะเปิดให้ใช้งานอย่างกว้างขวางขึ้น.

ผลการทดสอบใช้งานจริงของ FLUX 3 เป็นอย่างไร?

สามจากสามงานได้สำเร็จด้วย flux-3-video ID ของโมเดล ผลลัพธ์เป็นไปตามฉากระดับสูงที่ร้องขอ และการทดสอบหุ่นยนต์ยังคงรักษาลำดับการเคลื่อนไหวและลักษณะหลักไว้ได้ ทั้งสามคลิปมีระยะเวลา 5.04 วินาที แม้จะมีคำสั่งให้สร้างคลิปยาว 8 วินาที; การเว้นระยะระหว่างป้ายกำกับที่แม่นยำและรูปทรงผลิตภัณฑ์ที่ซ้ำกันยังไม่สมบูรณ์.

ผมสามารถใช้ FLUX 3 บน GlobalGPT ได้ไหม?

ใช่ครับ เส้นทางที่ได้รับการยืนยันคือ วิดีโอ FLUX 3 บน GlobalGPT. นอกจากนี้ เรายังได้ดำเนินการเสร็จสิ้นสามรุ่นผ่านสภาพแวดล้อมงานที่เชื่อมต่อกันเมื่อวันที่ 11 สิงหาคม 2026 การเข้าถึงแพลตฟอร์มนี้แยกต่างหากจากการเข้าถึง API BFL แบบตรงหรือการเข้าถึงน้ำหนักส่วนตัว.

ข้อสรุปสุดท้าย

FLUX 3 ไม่เพียงเป็นคำสัญญาบนหน้าเปิดตัวอีกต่อไป BFL ได้เผยแพร่ข้อมูลเกี่ยวกับความสามารถด้านวิดีโอและราคา GlobalGPT มีเส้นทางที่ได้รับการยืนยันแล้ว และการทดลองสามครั้งของเราได้ผลิตไฟล์ MP4 ที่ใช้งานได้พร้อมสตรีมเสียง โมเดลนี้จัดการกับตรรกะของฉากและการเคลื่อนไหวที่มีข้อจำกัดได้ดี แต่ยังไม่สามารถรักษาความยาวตามที่ต้องการได้ และทำให้ความแม่นยำของข้อความและความสม่ำเสมอของผลิตภัณฑ์ลดลง ลองใช้คำสั่งจริงของคุณก่อนที่จะปรับขนาด และติดตาม FLUX 3 Image, Action, private weights และใบอนุญาต FLUX 3 Dev อย่างต่อเนื่อง เมื่อส่วนต่าง ๆ ของตระกูลนี้พัฒนาขึ้น.

แชร์โพสต์:

โพสต์ที่เกี่ยวข้อง

แผงคำตอบการวิจัย AI แบบสรุป พร้อมการอ้างอิงที่เน้นไว้ ซึ่งเชื่อมโยงกับบัตรแหล่งข้อมูล

AI ของ Perplexity แม่นยำเพียงใด? วิธีตรวจสอบการอ้างอิงและแหล่งข้อมูล

AI ของ Perplexity มีความแม่นยำเพียงใด? มาเรียนรู้ว่าผลการวิจัยชี้ให้เห็นอย่างไร, เหตุใดการอ้างอิงจึงอาจผิดพลาด, และวิธีตรวจสอบแหล่งข้อมูลของ Perplexity ก่อนที่จะเชื่อถือคำตอบ.

อ่านเพิ่มเติม

วิธีเขียนจดหมายแนบสำหรับการส่งบทความไปยังวารสาร

คู่มือการเขียนจดหมายแนบสำหรับการส่งบทความไปยังวารสาร พร้อมโครงสร้างที่ใช้งานได้จริง แบบตัวอย่าง การตรวจสอบ และกระบวนการทำงานของ AI ที่รับผิดชอบ.

อ่านเพิ่มเติม

เครื่องมือจัดรูปแบบบทความ: กระบวนการทำงานก่อนส่งบทความที่ใช้งานได้จริง

เรียนรู้วิธีเตรียมเนื้อหาสำหรับเครื่องมือจัดรูปแบบบทความวิชาการ โดยไม่ใช้คำกล่าวอ้างทั่วไปหรือข้อผิดพลาดในการส่งบทความที่สามารถหลีกเลี่ยงได้.

อ่านเพิ่มเติม
ราคา GPT-6 Sol: ค่าใช้จ่าย API, ตัวอย่าง, เครื่องคำนวณ และตัวเลือกการสมัครสมาชิก

ราคา GPT-6 Sol: ค่าใช้จ่าย API, ตัวอย่าง, เครื่องคำนวณ และตัวเลือกการสมัครสมาชิก

เข้าใจการกำหนดราคา GPT-6 Sol โดยใช้อัตราโทเคนที่ OpenAI ได้เผยแพร่ การประมาณค่า API ที่ผ่านการทดสอบ เครื่องคำนวณที่ได้รับการตรวจสอบแล้ว การตรวจสอบด้วยตนเอง และตัวเลือกกระบวนการทำงานของ GlobalGPT.

อ่านเพิ่มเติม