# 阿里全新视频生成模型 Wan3.0 开启公测：单次生成 30 秒视频，支持文档输入

- 来源：IT之家（RSS）
- 发布时间：2026-08-06 20:33
- AIHOT 分数：73
- AIHOT 链接：https://aihot.virxact.com/items/cmshjall30g61ronkqdvsdkjr
- 原文链接：https://www.ithome.com/0/986/723.htm

## AI 摘要

阿里云今日宣布全新一代视频生成模型 Wan3.0 开启公测，单次可生成 30 秒视频，并首次支持 doc、xls、ppt、pdf、md 等文档格式输入，号称“万物皆可生视频”。

## 正文

IT之家 8 月 6 日消息，“阿里云”公众号今天（6 日）晚间宣布，全新一代视频生成模型 Wan3.0 开启公测。

Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升级，单次可生成 30 秒视频，完整表达创作意图；在文本、图片、音频、视频四种基础模态之外，首次支持 doc、xls、ppt、pdf、md 等文档格式输入，号称将让“万物皆可生视频”。

Wan3.0 支持单段 30 秒视频生成，带来更大的创作自由度，令连续运镜、一镜到底等复杂镜头语言得以充分表达，从“生成一个镜头”走向“讲述一段完整的故事”。

此外，Wan3.0 还支持智能时长功能，可根据提示词自动推荐合适时长；搭配视频延长功能，还能延展故事走向与剧情发展，让创意自然生长。

Wan3.0 不只支持文本、图片、音频、视频的全能参考，还能读取文档、表格、网页等结构化信息。搭配提示词，即可生成教学课件、产品演示、动态图表、业务汇报等内容，意味着大量的办公素材可以直接转化为视频。

支持的输入格式包括 doc、xls、ppt、pdf、txt、key、pages、numbers 以及 md，最多输入一个文件或链接，文件大小不超过 100MB，页数不超过 50 页。

此外，为告别 AI 人物的油腻感与千篇一律，Wan3.0 文生视频模式中的人像力求“千人千面”：更敏锐地刻画五官与皮肤细节，人物情绪表达自然克制，微表情与肢体动作彼此联动；即便是群像场景，也能细腻呈现不同人物的复杂情绪。

在全能参考任务中，Wan3.0 可精准复刻参考细节，保持角色、道具、声音、空间关系、风格等关键维度的一致性。对于角色，五官、发型发色、形体、服饰、配饰等细粒度特征均可稳定保持，避免出戏；对于道具，多角度外观、硬件结构、Logo、材质细节均保持稳定；对于场景，准确处理角色站位与机位视角的关系；对于风格，精准渲染影视拍摄调性，多风格创作时也不易发生风格混淆。

即日起，Wan3.0 在阿里云百炼、万镜一刻、万相官网和千问创作 PC 端开启公测，在千问 APP 灰度开放，480P/720P/1080P 的 API 价格分别为 0.3/0.6/1.2 元 / 秒，API 接口将于近期全量开放。

IT之家附体验地址：

阿里云百炼：https://bailian.console.aliyun.com/cn-beijing?tab=model#/model-market/detail/wan3.0-video

万镜一刻：https://www.yikeai.com/

万相官网：http://wanxiang.aliyun.com

千问创作 PC 端：https://c.qianwen.com/

IF STUDIO：https://ifs.iconfont.cn/

堆友：https://d.design/
