2026年8月26日
New
你的视频时长直接翻倍了。Wan 3.0 将单次生成的上限从 15 秒提升到整整 30 秒——无需再拼接片段。现已在 Text to Video、Image to Video 和 Video to Video 中上线。
核心优势:
单次生成最长 30 秒——足够容纳一整段场景,而不只是一个动作瞬间
遵循多镜头脚本,而非单一动作——按时间戳描述多个镜头,模型会自动处理镜头之间的转场
自动生成配乐——开启 Generate Audio 后,对白、拟音和音乐会与视频同步生成
可同时保留多个参考——图片、视频和音频共同引导身份、动作和声音
480p、720p 或 1080p——从快速草稿到最终成片,分辨率随需选择
以前需要拼接多个片段才能实现的多角色、连续动作长场景,现在只需一段精心撰写的提示词即可完成。
第一次接触 Wan 3.0?Mastering Wan 3.0 指南讲解了如何根据片段时长调整提示词长度——应用内的完整课程会讲得更深入。