快速回答: FLUX 3 是 Black Forest Labs 專為影像、影片、音訊及動作預測所開發的多模態基礎模型。截至 2026 年 8 月 11 日,BFL 將 FLUX 3 Video 列為「早期體驗」服務,支援最長 20 秒的片段、可選的原生音訊,並採用每秒計價的公開定價機制。 GlobalGPT 亦設有經驗證的 FLUX 3 Video 路徑。在我們進行的三次測試中,所有任務均成功完成並回傳了包含音訊流的 5.04 秒 MP4 檔案,但精確的時長控制、字體間距及物件一致性方面尚不完美。.
該條款的措辭仍需審慎斟酌。該 正式發布貼文 和 官方產品頁面 將 FLUX 3 Video 描述為「搶先體驗版」,而 BFL 的定價頁面現已公布影片服務的費率。GlobalGPT 提供了一條由該模型驅動的獨立平台路徑。透過該路徑進行存取,並不代表所有 BFL API、私有權重選項、Image 模型、Action 模型或 FLUX 3 開發版均已全面開放使用。.
此更新新增了一項簡單的實測:8月11日使用測試環境的 flux-3-video 模型 ID,其中包含一次完全相同的提示重複。這足以記錄實際行為和可見的失敗點,但僅有三組輸出結果並不足以作為廣泛的基準測試。.
三項由 FLUX 3 官方進行的影片測試——這並非廣泛的基準測試。.
| 跑壘 | 返回的持續時間 | 解析度 | 音訊 |
|---|---|---|---|
| 3/3 成功 | 5.04 秒 每段影片 | 1280 × 704 | 所有檔案中的解碼資料 |

什麼是 FLUX 3?
FLUX 3 是 Black Forest Labs 開發的一款多模態基礎模型。與僅經訓練用於將文字轉化為圖像的系統不同,BFL 表示該模型在單一架構中同時從圖像、影片和音訊中進行聯合學習。其目標是建構能連結空間結構、運動、聲音、因果關係與動作的表徵,而非將每種媒介視為孤立的特徵。.

這個名稱聽起來或許像是 FLUX.1 和 FLUX.2 的例行後繼產品,但其涵蓋範圍卻廣泛得多。FLUX.2 仍是一套現行的影像生成與編輯產品系列;該 FLUX 2 Pro 使用指南 涵蓋了該世代的影像工作流程、定價脈絡及提示機制。FLUX 3 被定位為內容創作與動作預測的共享基礎架構。.
BFL 使用「世界模型」一詞來描述這個方向。 此處並非指該公司已宣布實現通用智慧,而是指該模型旨在學習可見物體、動作、音訊及行為在時間軸上的相互關聯性。這項區別至關重要,因為 FLUX 3 最引人注目的主張並非單純的「更優質的影像」,而是透過單一基礎模型來支援多種生成與控制功能。.
為什麼 FLUX 3 不僅僅是一個圖像生成器
大多數創意的 AI 產品目前仍被視為獨立的工具:一個模型負責生成圖像,另一個負責製作影片,還有第三個負責添加語音或音效。FLUX 3 的設計理念則截然不同。如果單一架構能同時學習這些模態,那麼提示詞、參考圖像、動態序列和配樂便有可能共享相同的內部理解。.
- 圖片提供了空間: 物體、構圖、質感、字體設計以及視覺關係。.
- 影片會增加時間: 跨幀的運動、持續性、接觸以及因果關係。.
- 音訊會新增另一種同步訊號: 語音、環境音,以及與可見事件相關的聲音。.
- 動作預測將感知與控制連結起來: 該模型的表現形式可加以調整,用以預測機器人接下來應採取的行動。.
對創作者而言,其實用之處在於各生成階段之間的交接流程更為簡化。原生音訊尤其重要,因為它能縮短製作片段與後續獨立製作對白、音效及同步處理之間的差距。若音效是您的主要考量,目前的 Veo 3.1 聲音指南 展示了另一家領先的影音產品系列,目前是如何處理原生音訊的。.
FLUX 3 功能一覽
| 能力 | BFL 宣布的內容 | 截至 2026 年 8 月 11 日的情況 |
|---|---|---|
| FLUX 3 影片 | 影片生成與編輯,可選配原生音訊,包含語音、特效、風格、字體設計及多鏡頭工作流程 | BFL 搶先體驗;官方定價公布;GlobalGPT 航線已確認 |
| FLUX 3 圖片 | 透過 API 及私有權重存取進行影像生成與編輯 | 已宣布開放搶先體驗;本文並未進行測試 |
| FLUX 3 行動 | 原生動作預測,加上基於影片骨架建構的專用模型 | 從精選的合作夥伴開始 |
| FLUX 3 開發版 | 針對影片、音訊、影像及動作預測所規劃的開放式多模態核心架構 | 已公告;日期及許可證尚未公布 |
FLUX 3 Video 是最明確的近期產品。BFL 表示,該產品支援文字轉影片與編輯、音訊同步、多語言對白、多種畫面比例、排版以及片段串接。這些功能使其進入了一個日益競爭激烈的市場;該 最佳 AI 影片生成器比較 在 FLUX 3 的存取權限仍受限的情況下,這為創作者提供了關於現有可用功能的實用背景資訊。.
該發布貼文還描述了初步評估中,該模型能生成長度為 10 秒、解析度為 720p 且附有音訊的文字轉影片片段。BFL 明確指出,該模型及評估框架仍處於開發階段。這使得這些數據雖可作為公司初期報告的有用證據,但無法取代在公開存取範圍擴大後所進行的獨立、可重複測試。.
當前的產品頁面進一步說明:據稱 FLUX 3 Video 單次運行最多可生成 20 秒的影片,音訊為可選項,且會隨畫面同步生成多語言語音、特效及環境音效。這些是官方公布的性能限制;下方的實際測試記錄了透過連線平台途徑,系統根據我們的提示實際產出的內容。.
FLUX 3 目前已經上市了嗎?
是的,但僅限於分階段的「搶先體驗」。. BFL 目前開放的是申請管道,而非廣泛的自助式上線服務。因此,在模型、API、私有權重選項及評估流程仍在調整期間,該公司可與經篩選的用戶及合作夥伴進行合作。.

| 問題 | 已知 | 目前仍有限制或尚不清楚 |
|---|---|---|
| 一般人可以申請 BFL 嗎? | 是的,請透過官方申請表單 | 驗收標準與回應時間 |
| 使用者可以在 GlobalGPT 上試用 FLUX 3 Video 嗎? | 是的;經核實的產品連結如下 | 路線限制與配額取決於平台帳戶 |
| BFL 對外公佈的價格是多少? | 文字/圖片轉影片、續集、草稿、HD 及 FHD 畫質等級 | 私有權重與企業條款 |
| 會有開放級別的比賽嗎? | FLUX 3 Dev 預計採用開放級別 | 發行日期、授權條款及硬體需求 |

最穩妥的解讀很簡單:FLUX 3 確實存在且正在推出中,但「早期存取」不應被解讀為「對所有人開放」。若您有正式上線的截止期限,請在設計相關工作流程之前,先等待書面存取確認及相關條款。.
我們測試了 FLUX 3 影片:三次運行,真實輸出結果
測試設定: 我們於 2026 年 8 月 11 日,透過連接到該平台的 Broly 任務測試環境,使用完全相同的模型 ID 執行了測試 flux-3-video. 每個請求僅包含模型 ID 和提示詞。我們提交了三項任務:一則產品廣告提示詞、一則時間一致性提示詞,以及與第一則提示詞完全相同的提示詞。 任務 API 回報的實際處理時間分別為 88、190 和 77 秒。由於這些執行是並行進行的,且該路徑仍在持續優化中,因此這些時間數據不應被視為延遲基準。.
測試 1:排版、變換與原生音訊
任務編號: task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. 題目要求製作一支長度為八秒、採用雙人鏡頭的香水廣告,內容須包含精確的標籤文字、香水瓶轉化為城市的場景、玻璃瓶的「咔噠」聲、一聲「呼嘯」聲,以及一句台詞。.

發生了什麼事 最終成品完整呈現了要求的視覺弧線,並確保藍色香水概念在兩個場景中皆清晰可辨。標籤內容雖仍清晰可讀,但視覺上壓縮了要求的空間,外觀更接近「FLUX3」而非精確的「FLUX 3」。 在變形過程中,瓶身的瓶蓋與瓶身形狀亦有所改變。MP4 檔案中雖包含已解碼的音訊資料,但我們的自動化檢查系統並未將語音內容轉錄成文字,因此我們不會針對對話內容逐字進行評分。最重要的是,回傳的影片片段長度為 5.04 秒,而非要求的 8 秒。.
測試 2:單次動作與物體一致性
任務編號: task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. 此提示去除了場景轉換,並要求一個發條機器人按照固定順序穿越三個標記點,同時保留其特徵。.

發生了什麼事 這是較為乾淨的結果。機器人朝指定方向移動,並依序穿越黃色、藍色和綠色的標記。其主要辨識特徵在整個鏡頭中始終清晰可見,沒有多餘的元素或明顯的鏡頭切換。動作看起來簡潔而非電影化,但正是這種簡潔性,使得一致性更容易判斷。 這段影片的播放時間同樣為 5.04 秒,並包含已解碼的音訊資料。.
測試 3:與第一個提示完全相同
任務編號: task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. 我們再次發送了第一則提示,字字未改。.

發生了什麼事 這次的重現保留的是概念,而非確切的結果。畫面再次呈現出一個藍色瓶子、清晰可辨的「FLUX3」字樣、一道光帶以及夜色中的天際線,但瓶身的幾何造型、瓶蓋、構圖框架與過渡效果卻有所不同。 對於未設定初始條件的生成而言,這屬正常現象,但當品牌團隊期望產品細節具有可重複性時,這點便顯得至關重要。.
| 測試維度 | 觀察結果 | 實用要點 |
|---|---|---|
| 任務完成 | 3 項任務中有 3 項成功 | 在此次測試期間,該連接路線處於運作狀態 |
| 持續時間控制 | 這三個指令都要求 8 秒;結果都回傳 5.04 秒 | 在投入生產前,請驗證路線層級的時長控制設定 |
| 排版 | 標籤內容清晰可讀,但「FLUX 3」的精确間距並未保留 | 針對品牌文案,應規劃重試或後製流程 |
| 時間一致性 | 這個簡單的機器人保留了其特徵與標記順序 | 受限的單次提示表現依然相當出色 |
| 重複性 | 同樣的情境,不同的產品幾何形狀與相機選擇 | 提示語的完全重複不等同於視覺上的完全重複 |
| 音訊 | 每個 MP4 檔案都包含已解碼的音訊資料;對話內容並未自動轉錄 | 在批准前,請先聆聽並手動檢查同步狀況 |
我們的結論: FLUX 3 Video 在遵循高階場景邏輯方面,表現得比嚴格遵守製作限制更為出色。流暢的產品變形與機器人井然有序的移動都令人鼓舞。 固定的 5.04 秒回歸時間、文字間距不完美,以及瓶身形狀的偏移,都是您在正式部署前應先測試自身工作流程的原因。這是一個有用的實務參考指標,而非適用於整個模型的評分。.
FLUX 3 與 FLUX.2:究竟有哪些變化?
| 區域 | FLUX.2 | FLUX 3 |
|---|---|---|
| 主要公眾形象 | 影像生成與編輯系列 | 多模態基礎模型 |
| 治療方式 | 圖像與圖像編輯工作流程 | 圖像、影片、音訊與動作預測 |
| 當前存取權限 | 已發布的 API 模型與定價 | BFL 影片搶先觀看、官方影片定價,以及經確認的 GlobalGPT 路徑 |
| 開放模型方向 | 數種 FLUX.2 變體及其已記錄的終點 | FLUX 3 Dev 公開組賽事重量級別已公布,詳情待定 |
| 對表現的公正評價 | 今天即可作為影像模型進行測試 | 影片內容可以進行測試;但要對整個家族下定論,目前仍為時過早 |
最大的改變在於應用範圍,而非經過驗證的百分比提升。FLUX 3 並非僅是為 FLUX.2 賦予新的影像品質評分;其宗旨在於將創意生成與實體行動整合於同一個產品系列之中。對於當前僅基於影像的決策而言,該 FLUX 2 與 Nano Banana Pro 比較 這更具實用性,因為如今雙方皆可被視為影像工具來進行評估。.
若要對 FLUX 3 與 FLUX.2 進行全面比較,仍需考量匹配的圖像提示、參考編輯、排版、提示遵循度、延遲及成本等因素。上文提到的三輪影片測試雖已縮小了證據差距,且 BFL 現已公布 FLUX 3 影片的費率,但並未對圖像模型或開放權重變體進行比較。.
官方示範與機器人競賽結果所顯示的內容
BFL 的發布資料展示了生成式影片、同步音訊、視覺風格、動態文字以及初步的編輯功能。這些內容展現了產品的發展方向,以及該公司所鎖定的輸出類型。由於這些是經篩選的官方範例,因此無法讓我們得知一般使用者能以多高的頻率重現同等品質的成果、生成過程需要多長時間,或是每項成果的成本為何。.

機器人相關的工作則更具針對性。在 FLUX 3 × 模仿報告, BFL 與 mimic robotics 闡述了如何將 FLUX 3 影片骨幹系統應用於機器人動作預測。圖中顯示的軟體模型套件圖表顯示,FLUX-mimic 的中位數成功率為 95%,其中每條虛線標示的中位數均基於 20 次自主試驗。.
這是一項機器人學研究成果,而非影像或影片品質的基準測試。其意義在於概念層面:BFL 主張,經過訓練以建模運動、接觸、重量及因果關係的骨幹模型,能夠揭示對物理任務有用的表徵。至於相同方法能否廣泛應用於各類機器人、工廠及任務,則需要更廣泛的獨立證據來驗證。.
X 和 Reddit 上初期社群反應
FLUX 3 立即引起了廣泛關注。在 7 月 27 日的驗證快照中,該 BFL 在 X 平台上的官方公告 顯示有 6,088 個讚、862 次轉發、365 次引用及 314 則回覆。這些數據反映的是上市時的關注度,而非車款的可靠性,且這些數字將持續變化。.

A Reddit 論壇 r/StableDiffusion 中的貼文 標題為「Flux 3 看起來太瘋狂了。這只是一個提示」的貼文,在同一個驗證視窗中顯示了 370 個讚和 63 則留言。該貼文的分屏範例雖然使用了高難度的提示,但這仍僅是一個分享的範例,而非經過嚴謹控制的基準測試。.

正確的結論是,創作者們對提示詞的複雜度、動態表現、原生音效以及視覺一致性都抱持著好奇心。一旦使用範圍擴大,提示詞的可重現性應成為一項核心測試指標。與此同時,該 Kling 3.0 提示公式 這是一份實用的參考資料,可協助使用者在目前可用的影片工具中,規劃場景結構、攝影機行為、動作及限制條件。.
FLUX 3 API、定價及開放權重
截至 8 月 11 日,BFL 的 已公布的定價文件 包含 FLUX 3 Video。1 個學分等於 $0.01。 文字轉影片與圖片轉影片的費用為每秒 $0.17(HD 解析度)或每秒 $0.29(FHD 解析度),而 HD 草稿的費用則為每秒 $0.06。 影片延續功能在 HD 解析度下每秒收費 $0.43,FHD 解析度下每秒收費 $0.54;草稿模式則每秒收費 $0.12。.
| 項目 | 已發布或已核實 | 目前仍有限制或尚不清楚 |
|---|---|---|
| FLUX 3 影片定價 | T2V/I2V:$0.17/s 高畫質(HD),$0.29/s 全高畫質(FHD);草稿:$0.06/s。 續:$0.43/s 高畫質,$0.54/s 全高畫質;草案:$0.12/s | 私有權重與企業條款 |
| BFL 存取權限 | 影片搶先體驗、產品規格概覽及定價資訊已對外公開 | API 的通用接受準則、配額及帳戶特定限制 |
| GlobalGPT 存取 | 已驗證 FLUX 3 視訊產品路線,並成功完成三輪任務測試 | 帳戶配額及路由層級的控制措施可能與 BFL 的直接服務有所不同 |
| FLUX 3 開發版 | 規劃為開放重量級的多模式骨幹網路 | 發行日期、授權、參數大小及硬體需求 |
請勿將「開放權重」與「開源」混為一談。權重、程式碼、訓練資料及授權條款,各自可能有不同的存取條件。要對「開放權重」做出有意義的判斷,必須等到 BFL 正式發布 FLUX 3 Dev 的實際版本及授權條款後才能定論。.
如何申請 FLUX 3 搶先體驗版
- 開啟 FLUX 3 官方產品頁面 並檢視目前的能力標籤。.
- 點擊「請求」按鈕前往 FLUX 3 正式版搶先體驗申請表.
- 請說明您所需的功能——影片、圖片、動作、私有權重或開發者存取權限——以及您希望建置的工作流程。.
- 請提供一個切合實際的使用案例、預估使用量、組織詳情,以及說明為何早期存取對該專案至關重要。.
- 在確認存取權限、價格、限制或交貨日期之前,請先等待書面確認。.
具體的應用需求,比籠統的「我想試試看」更具說服力。舉例來說,一家製作公司可以說明,他們需要為品牌短片製作多語言對白和同步特效;而機器人團隊則可以闡述其操作任務、機器人平台、數據以及部署環境。.
如果目標是進行對話,請規劃完整的流程,而非僅著眼於生成提示語。該 Veo 3.1 對話與嘴型同步工作流程 突顯了若干實務層面的考量——包括講者發言時長、語調一致性、鏡頭設計以及內容重現——這些因素在評估《FLUX 3 Video》時同樣至關重要。.
哪些人適合觀看《FLUX 3》?
- AI 影片創作者 應留意原生音訊、多語言對白、剪輯、多鏡頭串接、一致性、節奏,以及最終定價。.
- 影像創作者 應等待涵蓋提示遵循度、參考資料編輯、排版及成本等面向的可重複比較結果。在此之前,該 2026 年測試過的最佳 AI 圖片生成器 這些是更實用的候選名單。.
- 開發者 應密切關注公開模型 ID、速率限制、SDK 支援狀況、私有權重條款,以及 FLUX 3 Dev 未來將採用的授權條款。.
- 機器人與物理人工智慧團隊 應檢視 FLUX-mimic 方法是否能應用於已發表任務之外的情境,以及需要多少任務特定的資料適應。.
在將製作工作流程投入正式運作之前,請使用四階段的 FLUX 3 就緒性檢查。啟動示範雖可通過「能力」階段的審查,但並未通過「存取權限」、「經濟性」或「證據」等階段的審查。.
| 大門 | 什麼是必然為真的 | 應蒐集的證據 |
|---|---|---|
| 存取 | 貴團隊已獲得所需能力的書面核准 | 帳戶邀請、條款、地區、配額及支援聯絡資訊 |
| 能力 | 該模型能完成您實際的任務,而不僅僅是展示用的提示語 | 配對提示、參考輸入、失敗案例及重複執行 |
| 經濟學 | 成本與交期均符合生產計畫 | 價格、生成時間、重試率、數量限制及基礎設施 |
| 證據 | 在選定的發布案例之外,結果仍具可信度 | 獨立測試、可重現的設定,以及帶有版本標記的輸出結果 |
想試試我們測試中使用的模型嗎? 開啟 FLUX 3 關於 GlobalGPT 的影片. 產品路線已上線,且相關的任務環境已於 2026 年 8 月 11 日完成所有三輪執行。在啟動生產批次之前,請先檢查您帳戶中顯示的控制項與配額。.
關於 FLUX 3 的常見問題
FLUX 3 是何時宣布的?
Black Forest Labs 於 2026 年 7 月 23 日宣布推出 FLUX 3。該發布貼文介紹了一款涵蓋圖像、影片、音訊及動作預測的多模態基礎模型,其功能將透過分階段的「搶先體驗」逐步推出,而非一次性全面公開發布。.
FLUX 3 是否已對外公開?
BFL 透過「早期存取」計畫提供 FLUX 3 Video 服務,並已公布其影片定價。GlobalGPT 亦具備經驗證的 FLUX 3 Video 產品路徑。這並不意味著 FLUX 3 Image、Action、私有權重或 FLUX 3 Dev 已全面開放自助服務;各項功能仍各有其推出時程與條款。.
FLUX 3 能否產生帶有原生音訊的影片?
是的。BFL 表示,FLUX 3 Video 能夠根據畫面生成多語言的語音、音效及環境音。我們在 8 月 11 日的測試中,三段 MP4 影片均包含已解碼的音訊資料。由於我們並未自動轉錄這些音軌,因此本次測試僅確認音訊的存在,而非對話內容是否完全準確。.
FLUX 3 也是影像模型嗎?
是的。影像生成與編輯功能屬於 FLUX 3 產品系列的一部分,但 BFL 表示,FLUX 3 Image 搶先體驗版將於首次公告後的數週內開放。截至本更新發布時,公開端點名稱、最終上市時間及定價尚未公布。.
FLUX 3 是開源軟體,還是「開放重量」?
BFL 已宣布將透過 FLUX 3 Dev 提供未來的開放權重存取功能。目前尚未公布發佈日期、授權條款、參數規模、程式碼範圍或硬體需求。在這些細節公布之前,與其稱之為「開源」,不如稱之為「計畫中的開放權重」更為準確。“
FLUX 3 與 FLUX.2 有什麼不同?
FLUX.2 主要是一個已公開端點與定價的當前影像生成與編輯系列。FLUX 3 則是一個更廣泛的多模態基礎架構,旨在串聯影像、影片、音訊及動作預測。若要進行公正的品質或成本比較,必須等到 FLUX 3 能更廣泛地供大眾使用之後。.
FLUX 3 的實機測試結果如何?
三項任務中有三項均已成功完成,並透過 flux-3-video 模型 ID。輸出結果符合所要求的頂層場景,且機器人測試保留了其動作順序與主要特徵。儘管提示長達八秒,這三個片段的長度均為 5.04 秒;標籤間距的精確度及產品幾何形狀的重現度尚不完美。.
我可以在 GlobalGPT 上使用 FLUX 3 嗎?
是的。已驗證的路線是 FLUX 3 關於 GlobalGPT 的影片. 我們亦已於 2026 年 8 月 11 日透過連線任務環境完成了三代運算。平台存取方式與直接透過 BFL API 或私有權重存取的方式不同。.
最終要點
FLUX 3 已不再僅是發布頁面上的承諾。BFL 已公布影片功能與定價,GlobalGPT 具備經驗證的執行路徑,而我們進行的三次運行均產出了附帶音訊流且可用的 MP4 檔案。該模型在處理場景邏輯與受限動作方面表現良好,但未能達到要求的時長,且在精確文字與產品一致性方面有所妥協。 請在調整提示語規模前先測試實際提示語,並持續關注 FLUX 3 Image、Action、私有權重以及 FLUX 3 Dev 授權,隨著該系列產品逐步成熟,這些部分也將持續優化。.



