阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频
最新 8 月 6 日消息,“阿里云”公众号今天(6 日)晚间宣布,全新一代视频生成模型 Wan3.0 开启公测。
Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30 秒视频,完整表达创作意图;在文本、图片、音频、视频四种基础模态之外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称将让“万物皆可生视频”。

Wan3.0 支持单段 30 秒视频生成,带来更大的创作自由度,令连续运镜、一镜到底等复杂镜头语言得以充分表达,从“生成一个镜头”走向“讲述一段完整的故事”。
此外,Wan3.0 还支持智能时长功能,可根据提示词自动推荐合适时长;搭配视频延长功能,还能延展故事走向与剧情发展,让创意自然生长。
Wan3.0 不只支持文本、图片、音频、视频的全能参考,还能读取文档、表格、网页等结构化信息。搭配提示词,即可生成教学课件、产品演示、动态图表、业务汇报等内容,意味着大量的办公素材可以直接转化为视频。
支持的输入格式包括 doc、xls、ppt、pdf、txt、key、pages、numbers 以及 md,最多输入一个文件或链接,文件大小不超过 100MB,页数不超过 50 页。
此外,为告别 AI 人物的油腻感与千篇一律,Wan3.0 文生视频模式中的人像力求“千人千面”:更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动;即便是群像场景,也能细腻呈现不同人物的复杂情绪。
在全能参考任务中,Wan3.0 可精准复刻参考细节,保持角色、道具、声音、空间关系、风格等关键维度的一致性。对于角色,五官、发型发色、形体、服饰、配饰等细粒度特征均可稳定保持,避免出戏;对于道具,多角度外观、硬件结构、Logo、材质细节均保持稳定;对于场景,准确处理角色站位与机位视角的关系;对于风格,精准渲染影视拍摄调性,多风格创作时也不易发生风格混淆。
即日起,Wan3.0 在阿里云百炼、万镜一刻、万相官网和千问创作 PC 端开启公测,在千问 APP 灰度开放,480P/720P/1080P 的 API 价格分别为 0.3/0.6/1.2 元 / 秒,API 接口将于近期全量开放。
最新附体验地址:
阿里云百炼:https://bailian.console.aliyun.com/cn-beijing?tab=model#/model-market/detail/wan3.0-video
万镜一刻:https://www.yikeai.com/
万相官网:http://wanxiang.aliyun.com
千问创作 PC 端:https://c.qianwen.com/
IF STUDIO:https://ifs.iconfont.cn/
堆友:https://d.design/
《阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频
Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30 秒视频,完整表达创作意图;在文本、图片、音频、视频四种基础模态之外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称将让“万物皆可生视频”。... -
马斯克预告下周将推 Grok 4.6 模型,改进 AI 监督微调和强化学习
在今天(8 月 5 日)召开的 SpaceX 公司 2026 年第 2 季度(截至 6 月 30 日)财报电话会议上,马斯克预告将于下周发布 Grok 4.6 模型。... -
消息称小米第二代 AI 眼镜延迟到 Q4 或明年发布,相关负责人否认
对于以上知情人士披露的信息,小米相关负责人进行了否认,并认为信息失实,属于造谣。对于真实情况,小米相关负责人也拒绝披露。... -
Cloudflare Wallet 推出:专为 AI 智能体设计的可编程钱包
Cloudflare 昨日(8 月 4 日)发布公告,宣布推出 Cloudflare Wallet 功能,针对 AI 智能体部署数字信用卡、身份证明(ID)以及消费上限机制。... -
视频能“边播边改”:京东开源自研 JoyAI-Video-Edit 模型,各项指标全球领先
JoyAI-Video-Edit 基于全自研 JoyAI-Video 模型,在 720P 分辨率下实现每秒 30 帧的模型推理速度,能够在保持较高画面清晰度的同时,跟上常见影视视频的播放节奏。...












