Wan 3.0 于 2026 年 8 月 7 日进入公开测试阶段。. 阿里巴巴目前通过 Wan.video、QwenCloud 和阿里云模型工作室提供该服务,但公开测试版并不意味着无限制访问、正式发布或可下载的模型权重。.
这一区别至关重要。Wan 3.0 是朝着更长、以音频为原生、以参考素材为导向的视频创作迈出的重要一步,但具体选择取决于您能否参与测试版、其按秒计费的定价模式是否符合您的工作流程,以及您是需要云端访问还是本地控制。.
在我们的首次输出测试中,Wan 3.0 严格遵循了“折纸船”这一为期五秒的受控提示,生成了一个画面清晰、可播放的 720P 视频片段。纸船的左右移动幅度较小,且仅凭一次运行尚无法证明其稳定性。.
GlobalGPT 这是一个面向希望在同一平台使用多个模型进行创作的用户的多模型AI订阅工作区。它提供了一种实用的方式,无需为每个模型重新构建工作流,即可对比当前的视频工具。.
其当前的 Wan 选项包括 Wan 2.7 和 Wan 2.6。对于 Wan 3.0,请使用本页面中介绍的官方测试版方案之一。.
简答
Wan 3.0 于 2026 年 8 月 7 日进入公开测试阶段。该版本新增了最多 30 秒的生成功能、原生音频支持、混合参考工作流,以及通过官方 Wan 和阿里巴巴路由提供的托管访问服务。.
wan3.0-video快速导航
Wan 3.0 已经发布了吗?
是的——作为一名 公开测试版. .......。 Wan官方账号于2026年8月7日宣布了该游戏的测试消息 并将用户引导至 Wan.video、阿里云模型工作室和 QwenCloud。.
该日期最好理解为公开测试版的发布公告,而非全球范围的全面发布。该 Qwen 云模型页面 将该模型标记为“beta”,并提供“加入 Beta”操作,因此账户访问权限仍属于该流程的一部分。.

对于用户而言,“已发布”现在有四种不同的含义:
- 公告: 公开测试版已正式发布。.
- 已列出: 官方产品和云服务页面上展示了该机型。.
- 可调用: 已获批准的账户可以提交受支持的任务。.
- 打开: 模型权重可以下载并在本地运行。.
Wan 3.0 满足前两个条件。第三个条件取决于路线和账户,而第四个条件不适用于当前版本。.
Wan 3.0 的主要功能有哪些?
Wan 3.0 定位为一款全能型视频模型,而非功能狭窄的文本转视频工具。其官方页面将参考、编辑、复制和生成功能整合到同一个模型中。.
功能一览
更长的原生代
可创建最长30秒的片段,具体时长限制因路线和模式而异。.
最长30秒音频和视频结合
在单一视听工作流中处理直接视觉动作、对话、环境音及其他声音事件。.
原生音频混合引用输入
当所选路径显示文本、图片、视频、音频、文件、网页或复杂图像时,请使用这些内容。.
全模式生成与转换
将生成、编辑、复制和基于动作的任务纳入同一模型框架之下。.
一种模式
最长30秒
此次升级的最大亮点是时长。QwenCloud表示,Wan 3.0 可以生成最长 30 秒的视频,而 Wan.video 则描述了具备智能时长控制功能的原生 30 秒视频。.
我们的 30 秒请求已被接受并进入处理阶段,但测试路由在返回视频之前超时了。此次运行显示了运行可靠性方面的局限性,并不意味着 Wan 3.0 不支持 30 秒请求。.
原生音频和视听同步
Wan 将图像和声音整合为一个视听工作流。在我们那个五秒钟的咖啡馆任务中,该流程生成了一个可播放的视频,其中包含真实的 AAC 立体声音轨、一名咖啡师、一个杯子摆放位置以及一个连续的场景。.
此外,生成的结果还在最后一个镜头中添加了格式错误的中文字幕,违反了“不添加字幕”的要求。我们已对音频流进行了核查,但并未独立转录对话内容,也未对咔嗒声、嘶嘶声以及帧级同步性进行审核。.
T1 · 第一个有效输出
部分满足要求
- 通过: 一位咖啡师、一个白色杯子、一个杯子摆放位置,以及一个连续的场景。.
- 部分观察到: 虽然存在音频轨道,但其中的旁白内容、陶瓷器皿的碰撞声、蒸锅的嘶嘶声以及精确的同步性均未经过独立审核。.
- 失败: 结尾处出现了一行不需要的、乱码的中文字幕。.
编辑限制: 该输出结果证明了真实立体声轨的传输,而非完美的语音准确性或帧级精确的声音同步。.
查看T1的具体提示
角色与对象的一致性
在一致性测试中,一位身穿黄色雨衣、戴着红色圆框眼镜的女子穿过雨中的集市。在整个连续跟拍过程中,她的面部、服装颜色、身体比例以及那把可见的红色雨伞都保持着异常稳定的状态。.
这一系列动作并未完成。她转向那个摊位,摸了摸那把收起的雨伞,但既没有把它捡起来,也没有一边拿着它一边继续走。.
T2 · 第一个有效输出
部分满足要求
- 通过: 一名女性,面部表情和身材比例稳定,身穿黄色雨衣,戴红色眼镜,从左向右行走,转身,连续镜头,无文字或重复画面。.
- 部分内容: 那把红伞依然清晰可辨,但她只是碰了碰它,并没有完成“拿起并携带”的动作。.
实用启示 身份持久性表现强劲;而多步骤对象交互的精确完成则是薄弱环节。.
查看T2的具体提示
摄像机与动作控制
在相机控制任务中,要求一名身穿蓝绿色夹克的骑行者从左向右骑行,同时相机从低角度的侧面位置缓慢向后移动。第一组输出结果保留了骑行者、骑行方向、水平地平线以及连续的沿海道路场景,未添加任何车辆、文字或其他骑行者。.
这是最干净利落的特写镜头。后撤动作流畅且清晰可辨,尽管骑手一直保持在相似的水平位置,因为摄像机是并排跟拍的。.
T3 · 第一个有效输出
胜任此任务
- 通过: 一名身穿蓝绿色夹克的骑车人,向右行驶,低角度拍摄,地平线水平,镜头平稳后拉,一个连续镜头。.
- 通过: 没有摄像机运动轨迹、可见剪辑痕迹、多余的骑行者、汽车、文字或标志。.
证据边界: 这是一次非常出色的首次输出,但并不能证明相同的相机控制能可靠地重复实现。.
查看T3的具体提示
全模式参考文献
该模型的官方描述中列出了音频、图像、文本和视频等受支持的输入类型。此外,描述中还提到该模型能够解析文件、网页和复杂图像,这使得工作流程不再局限于从头编写提示词。.
对于营销团队而言,这可能意味着从发布简报、产品图片、现有视频片段或参考页面着手。对于创作者而言,这可以减少将概念转化为连贯视频序列所需的工具数量。.
编辑、复制和工作流管理
Wan 3.0 将多项创意任务整合到一个模型体系中:
- 根据文本或混合参考资料生成一个新场景。.
- 编辑或扩展现有素材的视觉方向。.
- 在序列中复制主体、对象或样式。.
- 参考媒体驱动动作或表现。.
- 将视觉和音频指导工作合并为一个岗位。.
这些是官方支持的功能,并不保证每个路由都会提供所有控制选项。请根据您实际需要的输入模式选择路由,然后在处理大批量数据之前,先检查该账户显示的设置。.
Wan 3.0 与 Wan 2.x:有哪些变化?
最有参考价值的区分在于工作流程和可用性,而非某种推测性的质量评分。Wan 3.0 是全新的公开测试版模型,其核心在于更长的生成时长、原生音频以及全模态参考工作流程。.
Wan 2.x 系列是现有产品中已较为成熟的选择。在选择时,请首先根据您所需的工作流程以及当前可用的访问权限进行选择。.
根据工作流程选择,而非版本号
Wan 3.0 是测试路线;Wan 2.7 和 2.6 是当前实际使用的路线。.
| 决定 | Wan 3.0 | 万 2.7 / 2.6 |
|---|---|---|
| 当前状态 | 通过万网和阿里巴巴官方渠道参与公开测试 | 包括 GlobalGPT 在内的平台上的当前生产选项 |
| 官方强调 | 最长30秒,原生音频,混合参考音频,剪辑和配乐 | 实用且现成可用的文本/图像转视频工作流 |
| 选择它的最佳理由 | 您需要评估这种新的长篇、原生音频工作流程 选择新功能 | 您现在就需要在熟悉的多模型工作区中开始创作了 选择以获取访问权限 |
| 访问权衡 | Beta 版审批和针对特定路线的控制措施 | 在当前支持的平台上,Beta 版本的卡顿现象有所减少 |
如果您比较的是不同版本而非发布说明,请使用相同的提示和生产目标。我们的 Sora 2 与 Wan 2.5 的对比 该研究就模型选择如何改变工作流程提供了有用的背景信息,但其结果不应直接应用于Wan 3.0。.
Wan 3.0 可以在哪些地方使用?
从万所提到的三条路线中任选一条开始。每条路线都面向不同类型的用户。.
选择与工作相匹配的路线
这三条路线都是官方路线,但它们满足了不同的出行需求。.
Wan.video
一款面向创作者的可视化界面,让他们无需构建集成即可制作视频。.
最适合:动手创作QwenCloud
关于模型 ID、规格、Beta 版本、速率限制和定价的最权威公开信息来源。.
最适合:预算和API规划Model Studio
阿里云在应用与内容管道集成方面的“模型-市场”路径。.
最适合:现有的云工作流Wan.video
Wan.video 这是面向消费者的官方产品页面。其“Wan 3.0”行动号召会引导用户进入创建界面,用户需在此登录后才能开始任务。.
如果您希望采用可视化开发工作流,且无需构建 API 集成,请选择此方案。.
QwenCloud
QwenCloud 是关于规格、价格和确切型号 ID 最清晰的公开型号页面。该页面列出了 wan3.0-video, ,介绍了测试版申请流程,并展示了速率限制和 API 示例。.
如果您希望获得有详细文档记录的云端处理路径,并且能够接受测试版访问,请选择 QwenCloud。此外,在提交更长或分辨率更高的片段之前,这里也是计算预算最便捷的地方。.
阿里云模型工作室
阿里云模型工作室 这是面向开发者的选项。面向公众的模型市场路线指向新加坡地区,并采用相同的官方模型标识。.
当万代生成需要集成到更大的应用程序、自动化内容管道或现有的阿里云环境中时,请选择 Model Studio。.

GlobalGPT中一个实用的多模型工作流
如果当务之急是制作出成品视频,而非参与特定的测试版,那么GlobalGPT可将当前的Wan模型和其他视频生成器整合到一个工作区中。 已验证的列表包括 Wan 2.7、Wan 2.6、Veo 3.1、Sora 2、Kling 3.0 以及 Seedance 2.5。.
确保比较具有针对性:使用一个真实的提示词、相同的宽高比,并选取每个模型生成的首个可用结果。应重点比较动作表现、身份一致性、音频需求、交付周期以及后期编辑工作量,而非仅凭声誉来做出选择。.
如何使用 Wan 3.0
具体操作方式因产品而异,但可靠的设置步骤非常简单。.
1. 选择正确的官方途径
若需可视化创作工作流,请使用 Wan.video;若需云端文档和 API 集成,请选择 QwenCloud/Model Studio。请勿仅依赖完全匹配的域名;请确认该路由已由 Wan 或阿里巴巴连接。.
2. 确认模型身份并获取测试版访问权限
有关已记录的云端路线,请查找 wan3.0-video. 请按照平台提示完成“加入测试版”或“登录”步骤,然后确认该模型是否可供您的账户选择。.
3. 选择输入模式
从能够表达该任务的最小输入集开始:
- 正文 一个没有视觉参考的新场景。.
- 图片 保留一个产品、主题、作品或第一帧。.
- 视频 引导动作、编辑、复制或延续。.
- 文件或网页: 将一份素材简报或页面转化为视频创意。.
- 音频 当路线中出现相关内容时,引导其表现形式或视听结构。.
4. 审慎设定时长和分辨率
在提示词开发阶段请使用480P,因为其每秒帧率是列出的最低值。待场景、参考素材和时间轴都稳定后,再切换到720P或1080P;否则,一个微小的提示词错误就会演变成代价高昂的高分辨率错误。.
5. 编写一个可用于生产环境的提示词
一个实用的Wan 3.0提示应明确定义主题、动作、场景、摄像机运动、时间点、音频事件以及排除项。确保镜头序列在物理上可行,尤其是在请求连续长镜头时。.
- 在添加次要动作之前,先确定一个主要动作。.
- 用通俗易懂、按时间顺序的语言描述摄像机的运动。.
- 请为可见事件分配音效,而不是要求使用通用的“电影音效”。”
- 请说明哪些要素必须保持一致:面部、服装、产品、房间还是灯光。.
- 剔除不需要的文字、徽标、多余的人物或突兀的剪辑。.
如需进一步掌握镜头语言,请参阅本指南: AI 摄像机运动提示.
6. 在提高成本前进行审查
在延长时长或提高分辨率之前,请检查整个片段,而不仅仅是开头一帧。注意观察身份漂移、物体变化、不合理的运动、声音缺失、时间轴错误、多余文字以及末帧质量不佳等问题。.
若要做出更全面的模型决策,请将同一条提示语用于 GlobalGPT 的视频工作区. 针对您的实际任务对现有模型进行比较,比为每项任务寻找一个“最佳”模型更有用。.
我们的Wan 3.0实测:首次输出结果
2026年8月13日,我们通过Anywhere直接HTTP API测试了一项受控的文本转视频任务。该测试的目标很明确:即验证是否 wan3.0-video 能够根据一个固定的提示生成一段可用的五秒镜头,而无需选择效果更好的重掷结果。.
第一个完成的视频有效且可播放,因此被保留为结果。我们仅提交了该任务一次,未进行质量重试,也未运行稳定性批处理。.
实践方法论
一个冻结的请求,一个首个有效的输出
wan3.0-video查看确切的冻结提示
该任务在约213秒内从“排队中”状态变为“成功”。由于未进行稳定性测试,因此该配置仅支持基于首次输出的判断。.
首次输出结果
所有七项客观检查均已通过
| 主题与方向 | 通过 — 只有一艘红色的纸船依然可见,它从偏左的位置向中间移动。这种从左向右的移动是真实存在的,但非常微妙。. |
|---|---|
| 镜头与摄像机 | 通过 — 一个连续的镜头,没有明显的剪辑,且摄像机位置较低且稳定。. |
| 雨与倒影 | 通过 — 雨线、涟漪以及蓝、粉、紫色的倒影在整个片段中始终保持一致。. |
| 除外条款 | 通过 — 画面中未出现任何人物、文字、标志或额外的船只。. |
| 技术交付 | 通过 — 视频已成功播放,且符合要求的5秒、720P、16:9格式。. |
Wan 3.0 的价格是多少?
QwenCloud 根据生成秒数和分辨率对 Wan 3.0 进行定价。 2026年8月11日,该模型页面显示:480P每秒$0.05,720P每秒$0.10,1080P每秒$0.20。.
Wan 3.0 按分辨率划分的售价
QwenCloud 费率查询日期:2026年8月11日
每生成一秒的美元金额
| 决议 | 评分 | 相对速率 | 5 秒 | 10 秒 | 30秒 |
|---|---|---|---|---|---|
| 480P | $0.05/s简体中文(大陆) | $0.25 | $0.50 | $1.50 | |
| 720P | $0.10/s | $0.50 | $1.00 | $3.00 | |
| 1080P | $0.20/s | $1.00 | $2.00 | $6.00 |

定价采用线性计费模式:720P的费用是480P费率的两倍,而1080P的费用则是480P费率的四倍。 因此,按照QwenCloud的标价,一段30秒的1080P视频片段费用为$6.00,而480P的费用则为$1.50。.
这些数据适用于 QwenCloud,并不自动适用于 Wan.video、Model Studio、GlobalGPT 或其他服务提供商。在提交批次之前,请检查所选路由的当前计费单位、账户配额和故障处理政策。.
Wan 3.0 是开源的吗?API 和下载选项
Wan 3.0 是 未作为开源模型发布. QwenCloud 标注为“开源:否”,且截至 2026 年 8 月 10 日查询时,Wan 官方 GitHub 组织中并未列出 Wan 3.0 权重仓库。.
这并不妨碍用户通过托管服务访问该模型。但这确实意味着当前的实现方式是基于云的,而非可下载的本地计算工作流。.
Wan 3.0 API 模型 ID
QwenCloud 的官方型号 ID 是 wan3.0-video. 其公开示例包含分辨率、宽高比和时长等与视频相关的字段,但具体的请求格式、授权、区域端点以及可用控件应来自所选的官方云账户。.
下载视频并不等于下载模型
“Wan 3.0 下载”可以指代两种不同的操作:
- 下载生成的视频: 从托管产品中导出生成的 MP4 文件。.
- 下载模型权重: 在本地安装并运行底层模型。.
第一个是常规的输出工作流。第二个不属于当前的 Wan 3.0 版本。.
哪些人适合使用 Wan 3.0?
Wan 3.0 最吸引那些充分重视其新工作流、并愿意接受测试版访问和云服务定价的团队。.
它是以下领域的有力候选者:
- 创作者们正在探索时长更长的单镜头AI视频。.
- 希望同时生成视觉内容和原生音频的团队。.
- 基于产品图片、创意简报、文件或网页开展工作的营销人员。.
- 需要以参考素材为导向的品牌形象或风格一致性的工作室。.
- 开发人员已为云/API 工作流做好了准备。.
在以下情况下,应首先选择当前的替代方案:
- 你需要开放权重或完全本地化处理。.
- 你不能坐等测试版获得批准。.
- 对于您的生产环境而言,稳定的、成熟的控制措施比新功能集更为重要。.
- 您希望在不维护独立工作流的情况下,对多个模型进行比较。.
我们的建议很简单:如果30秒音频原生或混合引用内容创建功能能解决实际生产中的问题,那就加入官方测试版。这正是Wan 3.0提供最充分理由,让您接受测试版访问权限和云服务定价的地方。.
否则,请从以下内容开始: 万 2.7, Wan 2.6, ,或 GlobalGPT 中的另一款当前机型。请使用 最佳AI视频生成器指南 在确定生产工作流程之前,先缩小范围。.
常见问题
Wan 3.0 是何时发布的?
Wan 宣布,Wan 3.0 公开测试版已于 2026 年 8 月 7 日上线。此日期为公开测试版发布日期,并非正式发布或全面开放的日期。.
Wan 3.0 是否面向所有人开放?
不。官方页面上列出了该型号,但 QwenCloud 页面显示了“加入测试版”步骤,访问权限可能取决于所选路径、账户、审批情况和地区。.
Wan 3.0 可以在哪些地方使用?
Wan 将 Wan.video、阿里云 Model Studio 和 QwenCloud 列为官方渠道。Wan.video 面向创作者,而 QwenCloud 和 Model Studio 则更适合已文档化的云服务和 API 工作流。.
Wan 3.0 视频最长可以多长?
QwenCloud的官方页面显示,Wan 3.0最多可生成30秒的视频。可用的时长控制选项可能因路线和模式而异。.
Wan 3.0 会生成音频吗?
是的。Wan 将原生音频和集成化的视听体验作为 Wan 3.0 的核心功能。.
Wan 3.0 的价格是多少?
2026年8月11日, QwenCloud将480P的报价定为每秒$0.05,720P为每秒$0.10,1080P为每秒$0.20。 其他服务商可采用不同的价格或积分。.
Wan 3.0 是开源的吗?
不。QwenCloud 模型的官方页面上,开源状态显示为“否”,因此当前版本是托管测试版,而非开源模型包。.
我可以下载 Wan 3.0 的模型权重吗?
通过当前的官方版本无法实现。用户可以下载托管服务生成的视频,但这与下载模型权重以供本地使用是不同的。.
Wan 3.0 API 模型 ID 是多少?
QwenCloud 将官方型号 ID 记录为 wan3.0-video. 使用官方云账户提供的区域端点和请求格式。.
现在我可以用什么来处理视频呢?
GlobalGPT 目前提供 Wan 2.7 和 Wan 2.6,以及 Veo 3.1、Sora 2、Kling 3.0 和 Seedance 2.5。 请对一小组模型使用同一条提示词,并选择最符合您生产目标的结果。.
选择能解决您实际任务的工作流
Wan 3.0 值得关注,因为它将更长的视频、原生音频以及更广泛的参考输入整合到一个官方测试版中。接下来最好的做法不是一味追求所有功能,而是选择一项任务、一条路径和一个预算。.
将一个真实的提示带到 GlobalGPT 并尝试将其应用于当前可用的广角和视频机型。对比初始效果、后期剪辑工作量以及最终成片的适配效果——然后投资于真正物有所值的工作流程。.




