阿里 Wan 3.0 开启公测:单次生成 30 秒,文档可直接转视频
阿里云新一代视频生成模型 Wan 3.0 开启公测,单次可生成最长 30 秒视频,并支持 DOC、XLS、PPT、PDF、Markdown 等文档直接转视频。本文梳理公测入口、API 价格与小团队最值得验证的使用场景。
阿里云于 2026 年 8 月 6 日宣布新一代视频生成模型 Wan 3.0 开启公测。此次更新把单次生成时长提升到最长 30 秒,并将文档纳入输入范围:用户可以上传 DOC、XLS、PPT、PDF、Markdown 等文件,把课件、产品资料、图表或业务汇报直接转成视频。
公测已覆盖阿里云百炼、万镜一刻、万相官网和千问创作 PC 端,千问 App 采用灰度开放。对内容创作者和小团队来说,30 秒长镜头很醒目,文档到视频的工作流更值得关注。它让模型从“生成一段素材”进一步进入信息提取、画面组织和成片表达环节。
30 秒生成改变了哪些使用边界
多数 AI 视频工作流仍以短片段为基本单元。创作者先生成多个镜头,再处理角色漂移、画面衔接、节奏和配音。Wan 3.0 单次可生成最长 30 秒视频,目标是让较完整的镜头调度和故事推进在一次生成内完成,减少片段拼接造成的断裂。
公测信息还强调了人像真实感和群像表达。模型尝试呈现更细致的五官、皮肤与情绪差异,并在“全能参考”任务中维持角色、道具、场景和风格的一致性。结合智能时长功能,系统可以根据提示词推荐生成长度;已有视频还可以继续延长,用于扩展情节走向。
这些能力最终能否降低制作成本,不能只看最长时长。30 秒内人物是否稳定、镜头运动是否自然、动作和物体是否连续,都会直接影响可用片段率。公测阶段更适合把它当作生产测试,而不是默认每次都选择最长规格。
文档转视频让模型进入办公与内容生产
Wan 3.0 首次支持多类常见文档输入。相比把长文档手动改成提示词,这条路径试图让系统读取已有材料,再完成内容理解、时长安排和视觉呈现。
适合优先验证的任务包括:
- 把产品介绍或销售资料转成演示视频,检查卖点是否完整、顺序是否合理。
- 把教学课件转成知识短片,观察图表、术语和因果关系有没有被误读。
- 把表格或业务汇报转成动态图表视频,核对数字、单位和标签是否准确。
- 把 Markdown 脚本转成分镜初稿,评估它能否减少素材准备和粗剪时间。
文档输入降低了启动成本,也带来新的校对任务。数字、商品规格、价格、专业术语和品牌表达都不应直接交给生成结果决定。面向客户、教育或商业发布时,团队仍需逐项核对原始文件与成片,尤其要检查图表和小字。
文档转视频的价值不只在“省一次复制粘贴”,而在于它能否稳定保留原始信息,并给出可继续编辑的叙事结构。
公测入口和 API 成本怎么理解
目前不同用户可以从多个入口测试 Wan 3.0:
入口 | 当前状态 | 更适合的任务 |
|---|---|---|
万相官网、万镜一刻 | 已开启公测 | 视频创作、参考生成和人工试用 |
千问创作 PC 端 | 已开启公测 | 从文档和创作素材发起视频任务 |
千问 App | 灰度开放 | 移动端轻量体验,具体权限以账号为准 |
阿里云百炼 | 已开启公测 | 开发者评估模型与后续 API 接入 |
公测公布的 API 价格按输出时长计费:480P 为 0.3 元/秒,720P 为 0.6 元/秒,1080P 为 1.2 元/秒。按这一标准计算,一段 30 秒视频的单次生成费用分别为 9 元、18 元和 36 元,尚未计入重试、生成多个候选和后期处理成本。
API 接口仍计划在近期全量开放,正式可用时间、并发限制、失败任务计费、内容审核与服务稳定性还需要等待平台说明。开发者现阶段可以先完成效果和成本测试,不宜把尚未全量开放的接口直接写进生产排期。
小团队先测四个指标
Wan 3.0 的能力覆盖较广,公测时最好选一条真实业务链路,固定输入材料和验收标准,再与团队正在使用的视频模型横向比较。
- 信息保真度:文档中的数字、产品结构、术语和叙事重点能否准确进入视频。
- 长镜头稳定性:人物、道具和场景在 15 秒至 30 秒内是否持续一致,有没有明显漂移或形变。
- 有效成片成本:不要只记录每秒单价,还要统计重试次数、候选数量、后期修改时间和最终可用秒数。
- 工作流可接入性:导出格式、任务速度、账号额度和 API 状态能否满足批量生产,而非只完成单次演示。
如果团队主要制作商品短片,可以用同一份商品资料和参考图,分别生成 10 秒、20 秒和 30 秒版本;如果是知识内容,则可用一页课件或一份短报告测试信息保留情况。先找到模型容易出错的边界,再决定它适合做成片、分镜,还是素材草稿。
接下来要看全量 API 与真实成片率
Wan 3.0 已经给出清晰的产品方向:更长的单次生成、多维参考,以及从文档直接进入视频创作。但本次公测信息尚未确认开放权重、模型参数、公开基准成绩等细节,也不能据此判断它在所有视频任务中都优于现有工具。
下一阶段最重要的观察点是 API 何时全量开放、不同入口的能力是否一致,以及 30 秒复杂镜头在真实项目中的稳定性。对独立创作者和小团队而言,现在适合用可量化的任务参与公测,把可用片段率和总修改时间记下来。是否替换现有工具,应由这些结果决定。