一个模型,完成整部片子。
无需为文字、图片、视频或音频输入配备独立模型。阿里云的 Wan 3.0 通过单次调用处理所有参考素材,搭建整个镜头,并保持全程一致。
2–30s
单次生成即可获得 2 到 30 秒的原生视频。设定精确时长,或让智能时长功能读取你的素材并自动决定。
通用参考
单次调用最多支持 10 张图片、5 个视频片段和 5 条音轨,角色、道具、声音与空间布局均保持像素级一致性。
文字始终是文字
界面、动画和屏幕文字以结构化内容渲染,而非纹理。
自适应比例
五种固定画幅,覆盖 16:9 到 9:16,另有自适应模式:模型会读取你的素材并自行选择构图。
声音,默认原生生成。
音频与画面同步渲染,从第一帧起就已对齐。
4K
通过 Magnific 精修至 4K
该模型可渲染至 1080p。当镜头效果满意后,Magnific 的视频增强器可在不离开套件的情况下将其精修至 4K。


从最初的参考素材到 4K 母版
Wan 3.0 负责生成画面。前前后后的一切,交给 Magnific。
图像、视频、音频,一次调用即可完成。
在一次生成中为 Wan 3.0 提供最多 10 张图片、5 段视频和 5 条音轨,按场景需要自由组合。像素级一致性让一切保持统一:角色始终保持同一张脸,道具始终保持原位,每个镜头都不例外。
三十秒,一次成片。
一次生成三十秒原生视频,画面与声音同步呈现。设定你需要的确切秒数,或让智能时长读取故事并自行决定。镜头就此成为场景。
稳定呈现的界面、标题和文字。
软件界面、动画和屏幕文字以结构化内容渲染,每一帧都清晰可读。
成片自带原声
这里的声音不是后期步骤。音效和音乐与画面同步渲染,与屏幕上发生的一切保持同步。默认开启,需要静默时再关闭。
以 4K 完成,就在 Magnific 内。
Wan 3.0 原生渲染最高 1080p 的镜头。选出最满意的一条,通过 Magnific 增强器处理,全程不出套件即可交付 4K 成片,无需重新拍摄。


从一句提示词到一个完整场景
广告
一次生成即完成 30 秒广告片,产品、配乐与节奏从第一帧起就已锁定。
电商
呈现精确产品的产品主视觉。参考你已有的镜头,保留每一处细节。
社交
自带配乐的 Reels 内容。特效与音乐一应俱全,无需后期配音。
影视与 Originals
节奏张弛有度的微剧情与动作场景:一次生成即成完整故事弧。
工作室与代理机构
一个可复现的 Spaces 配置,打包为 flow,让整个团队都能重复输出成果。
常见问题
- Wan 3.0 是阿里云推出的全新一体化视频模型。不再区分文字转视频、图片转视频或编辑变体:一次调用即可处理所有输入。此外,还支持原生 30 秒生成、画面与声音同步渲染,以及具备像素级一致性的通用参考功能。
- 原生支持 2 到 30 秒时长。智能时长可读取你的提示词与素材,自动为你设定长度。
- 是的。音频与视频在同一次生成中完成,默认开启。如需静音,可将其关闭。
- 单次调用最多可使用 10 张图片、5 段视频片段和 5 条音轨,按场景需求自由组合,并在角色、道具、声音与空间上保持像素级一致性。
- 支持 16:9、4:3、1:1、3:4 和 9:16,以及自适应模式:模型会根据你的意图与素材自动选取画幅。
- Wan 3.0 最高可生成 1080p 视频。在 Magnific 中,你可以在构建参考素材和选定成片的同一位置,使用视频增强器完成 4K 输出。
- 可以。你可以通过 Magnific 的 MCP 和 API,在 Claude、ChatGPT、Cursor 或你自己的应用中运行 Wan 3.0,并使用你常规的 Magnific 积分。
使用 Wan 3.0 制作
存在地区限制。 须遵守可接受使用政策。

