广告团队
从一份需求出发,生成含画面、旁白和音乐的完整 30 秒广告,再逐版调整。
写一句描述、上传首帧,或提供多份参考素材,即可生成最长 30 秒的视频,包含对白、音乐和与语音同步的口型。
生成预览

Wan 3.0 是 Alibaba 的一体化视频模型,将文生视频、图生视频、参考素材驱动生成、编辑和延长整合在同一个模型中。输入一句描述或首帧,即可生成最长 30 秒、最高 1080p 的视频。原生音频让对白、音效和背景音乐与画面同时生成,角色口型也随台词变化。截至 2026 年 9 月,它以 Elo 1,242 位列 Artificial Analysis 文生视频(含音频)榜单第 1,领先 Gemini Omni Flash 和 MiniMax H3 Max。
按整秒选择时长,默认为 5 秒,也可让模型根据动作自动决定长度。
先用 480p 反复试稿,满意后以 1080p 生成;所有视频均为固定 30 FPS。
对白、环境音效和音乐与画面同时生成,角色口型随台词变化。
可选 16:9、4:3、1:1、3:4 或 9:16,也可保留自动适配。
组合图片、视频和音频,甚至 PDF、幻灯片或网页,让模型根据这些素材构建场景。
替换元素、调整画面风格、改写角色台词,或向视频前后延长,总时长最长 30 秒。
写下发生什么,也可以上传首帧、尾帧或参考素材。
选择 2–30 秒、480p 到 1080p,以及 16:9 到 9:16 的画幅,也可以让模型自动决定时长。
视频返回时已包含人声、音效和音乐。可以直接保留,也可以修改台词或继续延长。
过去需要多种工具配合的工作,现在可以一次生成。
从一份需求出发,生成含画面、旁白和音乐的完整 30 秒广告,再逐版调整。
用一张主视觉图生成视频:产品图作为开场,再由模型让画面动起来。
将 PDF、幻灯片或网页变成带旁白的讲解视频,无需先画分镜。
生成 9:16 竖屏场景,对白自带声音、口型同步,可用于信息流内容。
保持角色一致,逐镜头搭建电影感片段,再逐场景延长。
根据 Alibaba 发布公告,对比 Wan 2.7 API 系列的变化。
| 本站提供Wan 3.0一体化的新一代开始生成 | Wan 2.7上一代 API 系列 | |
|---|---|---|
| 单次最长时长 | 最长 30 秒 | 最长 15 秒 |
| 模型形态 | 一个模型完成参考驱动、编辑、生成和延长 | 分散在独立模型中 |
| 输入 | 文字与首尾帧,以及最多 20 份参考素材,包括文档和网页 | 输入类型较少 |
订阅可为账号补充积分:$19.90 包含 1,000 积分,可生成约 25 段 5 秒草稿,或 6 段 10 秒 720p 视频。
限时优惠,立省 30%!
单次可生成 2 到 30 秒,默认 5 秒,也可让模型按动作自动决定时长。延长视频后,总时长仍不超过 30 秒。
会。对白、环境音效和背景音乐与画面原生同步生成,角色嘴部动作随台词变化。
可以。图生视频可以从一张首帧开始,也可以同时指定首帧和尾帧,由模型生成中间的动作。
能。文档(PDF、Word、Excel、PowerPoint 等,最多 100MB 或 50 页)和网页链接都可直接作为参考输入,全部参考素材总计最多 20 份。
不支持。输出可选 480p、720p 或 1080p,固定 30 FPS,最高为 1080p。生成器默认 480p,方便以较低成本试稿。
不可以。它是付费托管模型,套餐每月 $19.90 起,包含 1,000 积分。生成按秒计费:5 秒 480p 草稿为 40 积分,10 秒 720p 视频为 150 积分。
没有。这一代是 Alibaba 的托管 API 模型。Alibaba 尚未发布 3.0 权重,可下载的开源模型最高为 Wan 2.2,因此 3.0 需要通过这样的托管生成器使用。
保留满意的版本,改写台词,延长结尾。写下提示词,开始你的第一个场景。