Wan 3.0 於 2026 年 8 月 7 日進入公開測試階段。. 阿里巴巴目前透過 Wan.video、QwenCloud 以及阿里雲模型工作室提供這項服務,但公開測試版並不代表可無限制存取、已正式上線,或可下載模型權重。.
這項區別至關重要。Wan 3.0 是邁向更長篇幅、以音訊為本且以參考素材為導向的影片製作的重要一步,但究竟該如何選擇,則取決於您能否參與測試版、其每秒計費模式是否符合您的工作流程,以及您是否需要雲端存取權限或本地端控制權。.
在我們的首次輸出測試中,Wan 3.0 嚴格遵循了為期五秒的「紙船」提示,並產出了一段畫質清晰、可播放的 720P 影片片段。紙船的左右移動幅度受到控制,且僅憑一次運行尚無法確立其穩定性。.
GlobalGPT 這是一個多模型 AI 訂閱式工作區,專為希望在同一個平台上使用多個模型進行創作的人士而設計。它提供了一種實用的方式,讓使用者無需為每個模型重新建立工作流程,即可比較現有的影片工具。.
其目前的 Wan 選項包括 Wan 2.7 和 Wan 2.6。若要使用 Wan 3.0,請採用本頁所述的官方測試版路徑之一。.
快速回答
Wan 3.0 於 2026 年 8 月 7 日進入公開測試階段。此版本新增了最多 30 秒的生成功能、原生音訊支援、混合參考工作流程,以及透過官方 Wan 和阿里巴巴路線提供的託管存取服務。.
wan3.0-video快速導覽
Wan 3.0 已經發布了嗎?
是的——身為一名 公開測試版. . 《萬》官方帳號於 2026 年 8 月 7 日宣布展開測試 並引導使用者前往 Wan.video、阿里雲模型工作室以及 QwenCloud。.
該日期最好理解為公開測試版的公告,而非全面性的全球發布。該 Qwen 雲端模型頁面 將該模型標記為「beta」,並提供「加入 Beta」操作,因此帳戶存取權限仍為流程的一部分。.

對使用者而言,「已發布」一詞現在有四種不同的含義:
- 公告: 公開測試版已正式推出。.
- 已列出: 官方產品頁面和雲端頁面均展示了該機型。.
- 可呼叫: 已核准的帳戶可提交受支援的工作。.
- 開放時間: 模型權重可下載並在本地執行。.
Wan 3.0 符合前兩個條件。第三個條件取決於路線和帳戶,而第四個條件則不適用於當前版本。.
Wan 3.0 的主要功能有哪些?
Wan 3.0 的定位是一款全能型影片模型,而非功能侷限的文字轉影片工具。其官方頁面將參考、編輯、複製及驅動等功能整合於單一模型之下。.
所有功能一覽無遺
更長的原生世代
可製作最長 30 秒的片段,其時長控制會因路線和模式而異。.
最長 30 秒音訊與視訊結合
在單一的視聽工作流程中,整合直接視覺動作、對話、環境音及其他聲音事件。.
原生音訊混合參考輸入
當選定的路徑顯示文字、圖片、影片、音訊、檔案、網頁或複雜圖像時,請使用這些內容。.
全模式產生與轉換
將生成、編輯、複製及動作驅動等任務納入同一模型識別範疇之下。.
一個模型
最長 30 秒
最主要的升級在於影片長度。QwenCloud 表示 Wan 3.0 最多可生成 30 秒的影片,而 Wan.video 則描述其具備原生 30 秒影片長度,並搭配智慧型長度控制功能。.
我們的 30 秒請求已獲接受並進入處理階段,但測試路徑在傳回影片前已超時。此次執行結果顯示了運作可靠性上的限制,並非表示 Wan 3.0 缺乏對 30 秒請求的支援。.
原生音訊與影音時序
Wan 提倡將影像與聲音整合為一體的視聽工作流程。在我們為期五秒的咖啡廳任務中,該流程產出了一段可播放的影片,其中包含真實的 AAC 立體聲音軌、一名咖啡師、一個杯子擺放位置,以及一個連續的場景。.
此外,最終鏡頭中還出現了格式錯誤的中文字幕,違反了「不得出現字幕」的指示。我們已驗證音訊串流,但並未獨立轉錄對白內容,亦未審核咔嗒聲、嘶嘶聲以及幀級同步性。.
T1 · 第一個有效的輸出
部分達成任務
- 通過: 一位咖啡師、一個白色杯子、一個擺放位置,以及一個連續的場景。.
- 部分觀察到: 雖然存在音軌,但其中的旁白內容、陶瓷碰撞聲、蒸籠的嘶嘶聲,以及精確的同步性,均未經獨立審核。.
- 失敗: 結尾處出現了一行不必要的、亂碼的中文字幕。.
編輯限制: 此輸出結果證明確實傳輸了真實的立體聲軌,而非完美的語音精準度或幀級精準的聲音同步。.
查看 T1 的確切提示
角色與物件的一致性
在一致性測試中,一名身穿黃色雨衣、戴著圓形紅框眼鏡的女子穿行於雨中的市場。在整段連續跟拍鏡頭中,她的臉部、服裝色彩、比例,以及那把可見的紅色雨傘,都保持著異常穩定的狀態。.
這系列動作並未完成。她轉身走向那間隔間,輕觸了那把收起的雨傘,但既沒有拿起它,也沒有一邊拿著它一邊繼續走。.
T2 · 第一個有效的輸出
部分達成任務
- 通過: 一名女性,面部表情與身形比例穩定,身穿黃色雨衣,戴著紅色眼鏡,從左向右行走,轉身,畫面連續,且無文字或重複鏡頭。.
- 部分內容: 那把紅傘依然清晰可辨,但她只是輕觸了它,卻沒有完成「拿起並攜帶」的動作。.
實用要點: 身分識別的穩定性相當強;而精確完成多步驟的物件互動則是弱點。.
查看 T2 的確切提示
攝影機與動作控制
在「攝影機控制」任務中,一名身穿青綠色夾克的自行車騎士被要求從左向右騎行,同時攝影機從低角度、側向拍攝的位置緩慢向後拉遠。首個輸出畫面保留了騎士、行進方向、水平地平線,以及連續的沿海道路場景,且未添加任何車輛、文字或其他自行車騎士。.
這是最乾淨俐落的特寫鏡頭。回撤動作流暢且清晰可辨,儘管騎手始終維持在相似的水平位置,因為攝影機是從側邊跟拍而來的。.
T3 · 第一個有效的輸出
能勝任這項任務
- 通過: 一名身穿青綠色夾克的自行車騎士,向右行進,低角度鏡頭,地平線水平,平穩的拉遠鏡頭,以及一個連續的場景。.
- 通過: 不得出現鏡頭軌跡、明顯的剪接痕跡、多餘的自行車騎士、汽車、文字或標誌。.
證據範圍: 這是一次表現強勁的首次輸出,但並不能證明相同的相機控制能可靠地重複實現。.
查看 T3 的確切提示語
多式聯運參考資料
官方模型說明中列出了音訊、圖片、文字和影片等受支援的輸入類型。說明中還提到,該模型能夠解析檔案、網頁和複雜的圖片,這使得工作流程不再僅限於從頭撰寫提示語。.
對行銷團隊而言,這可能意味著從上市簡報、產品圖片、現有影片片段或參考頁面著手。對創作者來說,這能減少將概念轉化為連貫影片序列所需的工具數量。.
編輯、複製及工作流程的執行
Wan 3.0 將多項創意任務整合為單一的品牌形象:
- 根據文字或混合參考資料生成一個新場景。.
- 編輯或擴展現有素材的視覺方向。.
- 在整個序列中複製主體、物件或樣式。.
- 參考媒體可驅動動作或表現。.
- 將視覺與音效指導整合於單一職務中。.
這些是官方支援的功能,並不保證每個路徑都會提供所有控制項。請根據您實際需要的輸入模式選擇路徑,然後在處理大量批次之前,先檢查該帳戶所顯示的設定。.
Wan 3.0 與 Wan 2.x:有哪些變化?
最具實用價值的區別在於工作流程與可用性,而非某種推測性的品質分數。Wan 3.0 是全新的公開測試版模型,其核心在於更長的生成時間、原生音訊以及全模態參考工作流程。.
Wan 2.x 系列是現有產品中已較為成熟且廣泛採用的選擇。在選擇時,請首先根據您所需的工作流程以及目前可用的存取權限來決定。.
根據工作流程選擇,而非版本號
Wan 3.0 是測試路線;Wan 2.7 和 2.6 則是目前實際使用的路線。.
| 決定 | Wan 3.0 | 萬 2.7 / 2.6 |
|---|---|---|
| 目前狀況 | 透過官方的萬網及阿里巴巴管道進行公開測試 | 目前在包括 GlobalGPT 在內的平台上可選的生產方案 |
| 官方重點 | 最長 30 秒、原生音訊、混合參考音軌、剪輯與配樂 | 實用且現有可用性更廣泛的文字/圖片轉影片工作流程 |
| 選擇它的最佳理由 | 您需要評估這套全新的長篇、原生音訊工作流程 選擇以獲得新功能 | 您現在就該在熟悉的多模型工作區中開始創作了 選擇以取得存取權限 |
| 存取權衡 | Beta 審核與路線特定控制措施 | 在目前支援的平台上,Beta 版本的運作更為順暢 |
若您比較的是不同版本而非發行說明,請使用相同的提示與生產目標。我們的 Sora 2 與 Wan 2.5 的比較 雖然這提供了有關模型選擇如何改變工作流程的有用背景資訊,但其結果不應套用至 Wan 3.0。.
Wan 3.0 可以在哪些地方使用?
請從萬所列出的三條路線中選擇其中一條開始。每條路線都針對不同類型的使用者。.
選擇與工作相符的路線
這三條路線均為官方路線,但各自滿足不同的通行需求。.
Wan.video
專為希望製作影片卻無需建置整合功能的創作者所設計的視覺化介面。.
最適合:動手創作QwenCloud
關於模型 ID、規格、Beta 級別、速率限制及定價的最清晰公開資訊來源。.
最適合:預算規劃與 API 規劃Model Studio
一種適用於應用程式與內容處理流程整合的阿里雲「模型-市場」路徑。.
最適合:現有的雲端工作流程Wan.video
Wan.video 這是官方面向消費者的產品頁面。其「Wan 3.0」的行動呼籲會引導使用者進入建立介面,使用者需在此登入後才能開始執行任務。.
若您希望採用視覺化建置工作流程,且無需建立 API 整合,請選擇此途徑。.
QwenCloud
QwenCloud 是關於規格、定價及確切型號 ID 最詳盡的公開型號頁面。該頁面列出了 wan3.0-video, 介紹了 beta 版申請步驟,並說明了速率限制與 API 範例。.
若您希望採用有完整文件記錄的雲端傳輸路徑,且能配合測試版存取流程,請選擇 QwenCloud。此外,在提交較長或高解析度的片段之前,這裡也是計算預算最簡潔明瞭的場所。.
阿里雲模型工作室
阿里雲模型工作室 這是面向開發者的選項。公開的模型市場路線指向新加坡地區,並採用相同的官方模型識別標識。.
當 Wan Generation 需要整合至較大型的應用程式、自動化內容處理流程或現有的阿里雲環境中時,請選擇 Model Studio。.

GlobalGPT 中的實用多模型工作流程
如果當前的目標是製作出完整的影片,而非參與特定的測試版計畫,GlobalGPT 會將現有的 Wan 模型及其他影片生成器整合到同一個工作區中。 經驗證的清單包含 Wan 2.7、Wan 2.6、Veo 3.1、Sora 2、Kling 3.0 以及 Seedance 2.5。.
請讓比較保持聚焦:使用一個真實的提示詞、相同的長寬比,並從每個模型中選取第一個可用的結果。應比較動態表現、角色一致性、音訊需求、處理時間以及後製工作量,而非僅憑聲譽來選擇。.
如何使用 Wan 3.0
具體的操作方式因產品而異,但可靠的設定步驟相當簡單明瞭。.
1. 選擇正確的官方途徑
若需視覺化創作者工作流程,請使用 Wan.video;若需雲端文件與 API 整合,則可選擇 QwenCloud/Model Studio。請避免僅依賴完全匹配的網域名稱;請確認該路由已由 Wan 或阿里巴巴連結。.
2. 確認模型身分及 beta 版存取權限
關於已記錄的雲端路徑,請查找 wan3.0-video. 請依照平台顯示的指示,完成「加入 Beta 測試」或「登入」步驟,然後確認您的帳戶是否可選取該模型。.
3. 選擇輸入模式
從能夠表達該任務的最小輸入集開始:
- 文字: 一個沒有視覺參考的新場景。.
- 圖片: 保留某項產品、主題、作品或第一幀畫面。.
- 視訊: 引導動作、編輯、複製或延續。.
- 檔案或網頁: 將一份素材簡報或頁面轉化為影片概念。.
- 音頻: 當路線呈現相關特徵時,請引導其表現或視聽結構。.
4. 審慎設定持續時間與解析度
在提示詞開發階段請使用 480P,因為其每秒幀率是列出的最低值。待場景、參考素材和時序都穩定後,再切換至 720P 或 1080P;否則,一個微小的提示詞錯誤,就會演變成代價高昂的高解析度錯誤。.
5. 撰寫一個可供實際部署的提示語
一個實用的 Wan 3.0 提示應明確界定主題、動作、場景、鏡頭運作方式、時間點、音效事件以及排除項目。請確保該鏡頭序列在物理上可行,特別是在要求連續長鏡頭時。.
- 在加入次要動作之前,請先指定一個主要主題。.
- 請以淺顯易懂且按時間順序的語言,描述鏡頭的移動方式。.
- 請為可見的事件指派音效,而非要求泛用的「電影級音效」。“
- 請說明哪些要素必須保持一致:臉部、服裝、產品、房間或燈光。.
- 請移除不需要的文字、標誌、多餘的人物,或突兀的剪接。.
若想更深入掌握鏡頭語言,請參閱這份指南: AI 攝影機移動提示.
6. 調漲價格前應先進行審查
請檢查整個片段,而不僅是開頭一幀。在延長片段長度或提高解析度之前,請留意身份偏移、物件變化、不合理的運動、聲音缺失、時間軸錯誤、不必要的文字,以及末幀畫質不佳等問題。.
若要做出更廣泛的模型決策,請將同一條提示語用於 GlobalGPT 的影片工作區. 將現有模型應用於您的實際任務進行比較,比試圖尋找一個適用於所有任務的最佳模型更有用。.
我們的 Wan 3.0 實機測試:首份測試報告
我們於 2026 年 8 月 13 日透過 Anywhere 直接 HTTP API 測試了一項受控的文字轉影片任務。該測試的目標很明確:旨在確認是否 wan3.0-video 能夠從一個凍結的提示中生成一段可用的五秒鏡頭,而無需選擇外觀更佳的重擲結果。.
首支完成的影片有效且可播放,因此被保留為結果。我們僅提交該任務一次,未進行任何品質重試,也未執行穩定性批次處理。.
實作式方法論
一個凍結的請求,一個首個有效的輸出
wan3.0-video檢視確切的凍結提示
該任務在約 213 秒內從「排隊中」狀態轉為「成功」。由於未進行穩定性測試,因此此設定僅支援「首次輸出」的判斷。.
首次輸出結果
所有七項客觀檢查均已通過
| 主題與方向 | 通過 — 唯有一隻紅色的紙船仍可見,它從偏左的位置朝中間移動。這左向右的移動是真實的,但幅度很微小。. |
|---|---|
| 鏡頭與攝影機 | 通過 — 一個連續的鏡頭,沒有明顯的剪接,且採用穩定的低角度拍攝。. |
| 雨與倒影 | 通過 — 雨線、漣紋,以及藍色/粉紅至紫色的倒影在整個片段中始終保持一致。. |
| 除外事項 | 通過 — 畫面中未出現任何人物、文字、標誌或額外的船隻。. |
| 技術交付 | 通過 — 影片已成功播放,且符合要求的五秒、720P、16:9 格式。. |
Wan 3.0 的價格是多少?
QwenCloud 根據生成時間(每秒)及解析度,為 Wan 3.0 定價。 2026年8月11日,該模型頁面列出 480P 每秒 $0.05、720P 每秒 $0.10,以及 1080P 每秒 $0.20。.
Wan 3.0 依解析度劃分的價格
QwenCloud 費率查閱日期:2026年8月11日
每產生一秒的美元金額
| 解析度 | 評分 | 相對速率 | 5 秒 | 10 秒 | 30 秒 |
|---|---|---|---|---|---|
| 480P | $0.05/s | $0.25 | $0.50 | $1.50 | |
| 720P | $0.10/s | $0.50 | $1.00 | $3.00 | |
| 1080P | $0.20/s | $1.00 | $2.00 | $6.00 |

定價採線性計費:720P 的費用是 480P 的兩倍,而 1080P 的費用則是 480P 的四倍。 因此,以標示的 QwenCloud 費率計算,一段 30 秒的 1080P 影片需支付 $6.00,而 480P 影片則需支付 $1.50。.
這些數值適用於 QwenCloud,並不自動適用於 Wan.video、Model Studio、GlobalGPT 或其他供應商。在提交批次前,請先確認所選路徑的當前計費單位、帳戶配額及失敗政策。.
Wan 3.0 是開源軟體嗎?API 與下載選項
Wan 3.0 是 未以開源模型授權的形式發布. QwenCloud 標示為「開源:否」,且於 2026 年 8 月 10 日查閱時,Wan 官方 GitHub 組織並未列出 Wan 3.0 權重儲存庫。.
這並不會阻止使用者透過託管服務存取該模型。這確實意味著目前的運作方式是基於雲端的,而非可下載的本地端運算工作流程。.
Wan 3.0 API 模型 ID
QwenCloud 的官方型號編號為 wan3.0-video. 其公開範例包含解析度、長寬比和播放時間等與影片相關的參數,但確切的請求格式、授權、區域端點以及可用的控制項,應參照所選的官方雲端帳戶。.
下載影片不等同於下載模型
“「Wan 3.0 下載」可以指兩種不同的動作:
- 下載生成的影片: 從託管產品中匯出完成的 MP4 檔案。.
- 下載模型權重: 在本地安裝並執行底層模型。.
第一種是標準的輸出工作流程。第二種則不屬於當前的 Wan 3.0 版本。.
哪些人適合使用 Wan 3.0?
Wan 3.0 對那些十分重視其新工作流程、並願意接受測試版存取權限及雲端定價的團隊而言,最具吸引力。.
它是以下項目的有力候選者:
- 創作者正嘗試製作更長的單鏡頭 AI 影片。.
- 希望同時生成視覺內容與原生音訊的團隊。.
- 以產品圖片、簡報、檔案或網頁為依據進行工作的行銷人員。.
- 需要以參考為導向的品牌形象或風格一致性的工作室。.
- 開發人員已為雲端/API 工作流程做好準備。.
在以下情況下,應優先選擇當前的替代方案:
- 您需要開放式權重或完全在本地進行的處理。.
- 您不能坐等 beta 版本的核准。.
- 您的生產環境比新增功能集更需要穩定且成熟的管控措施。.
- 您希望比較多個模型,同時無需維護各自獨立的工作流程。.
我們的建議很簡單:如果 30 秒、原生音訊或混合參考的創作功能能解決實際的製作問題,就請加入官方測試版。這正是 Wan 3.0 提供最明確理由,讓您接受測試版存取權限與雲端定價方案之處。.
否則,請從以下開始: 萬 2.7, 萬 2.6, ,或 GlobalGPT 中的另一款現行機型。請使用 最佳 AI 影片生成器指南 在確定生產工作流程之前,先縮小選擇範圍。.
常見問題
Wan 3.0 是何時發行的?
Wan 宣布,Wan 3.0 公開測試版已於 2026 年 8 月 7 日上線。此日期為公開測試版發布日期,並非正式版或開放權重版本的發布日期。.
Wan 3.0 是否對所有人開放?
不。官方頁面雖列出了機型,但 QwenCloud 會顯示「加入 Beta 測試」步驟,且能否存取可能取決於所選的路線、帳戶、審核結果及地區。.
Wan 3.0 可以在哪些地方使用?
Wan 將 Wan.video、阿里雲 Model Studio 以及 QwenCloud 列為官方通路。Wan.video 主要面向創作者,而 QwenCloud 和 Model Studio 則更適合已建檔的雲端及 API 工作流程。.
Wan 3.0 的影片最長可以有多長?
QwenCloud 的官方頁面指出,Wan 3.0 最多可生成 30 秒的影片。可用的時長控制選項可能因路線和模式而異。.
Wan 3.0 會產生音訊嗎?
是的。Wan 將原生音訊與整合式影音體驗作為 Wan 3.0 的核心功能。.
Wan 3.0 的價格是多少?
2026年8月11日, QwenCloud 將 480P 的價格定為每秒 $0.05,720P 為每秒 $0.10,1080P 則為每秒 $0.20。 其他供應商可採用不同的價格或積分。.
Wan 3.0 是開源軟體嗎?
不。QwenCloud 的官方型號頁面將「開源」標示為「否」,因此當前版本屬於託管版測試版,而非開源模型套件。.
我可以下載 Wan 3.0 的模型權重嗎?
目前官方版本尚不支援此功能。使用者可以下載由託管服務所產生的影片,但這與下載模型權重以供本地使用是兩回事。.
Wan 3.0 API 模型 ID 是什麼?
QwenCloud 記錄的官方型號編號為 wan3.0-video. 請使用官方雲端帳戶所提供的區域端點及請求格式。.
目前我可以用什麼來進行影片製作呢?
GlobalGPT 目前提供 Wan 2.7 和 Wan 2.6,以及 Veo 3.1、Sora 2、Kling 3.0 和 Seedance 2.5。 請針對一小組模型使用同一則提示詞,並選擇最符合您生產目標的結果。.
選擇能解決您實際任務的工作流程
Wan 3.0 值得關注,因為它將更長的影片、原生音訊以及更廣泛的參考輸入整合於單一官方測試版中。最佳的下一步並非一次追逐所有功能;而是選擇一項任務、一條路徑以及一筆預算。.
將一個真實的提示帶到 GlobalGPT 並試著將其應用於目前可用的廣角鏡頭與影片機型。比較最初的成果、剪輯所需的心力,以及最終成片的契合度——然後才投資於真正物有所值的工作流程。.




