时长以整秒为单位,从 2 秒到 30 秒随你定。半分钟足够让一个场景完整地发生:厨师从放下第一样食材一直做到摆盘点缀,镜头在店铺里缓缓穿行,人物走进画面再做出反应,这些都能在一次生成里完成,不必把好几段短片拼接起来。
IAllegro
Wan 3.0 视频生成:长镜头与多张参考图
Wan 3.0 属于阿里巴巴的 Wan 系列视频模型。当一个场景需要足够的时间慢慢展开,或者同一个人物、同一件商品要从第一秒到最后一秒都认得出来,就该打开它。你可以从一句提示词、一张首帧图或最多 10 张参考图开始,时长在 2 到 30 秒之间任选,然后直接在下方的生成器里出片。
当前模型Wan 3.0
Andante
Wan 3.0 参数与限制
生成器里能调的选项都集中列在这里,花积分之前,先把这个镜头规划清楚。
- 起始方式
- 文生视频;首帧图生视频(可另加一张尾帧);参考图生视频
- 时长
- 2 到 30 秒之间的任意整数秒
- 分辨率
- 480P、720P 或 1080P
- 画面比例
- 自适应(跟随输入素材)、16:9、9:16、1:1、4:3、3:4
- 参考图
- 最多 10 张,按上传顺序在提示词里称为 Image1、Image2,依此类推
- 声音
- 与画面一起生成;音频开关默认开启,可以随时关掉
- 提示词长度
- 最多 5000 个字符
- 积分
- 随时长和分辨率实时变化,显示在生成按钮上;生成失败会自动退回
- 账号与保存
- 需要登录 Sonata AI 账号;做好的视频保存在历史记录里
Adagio
为长镜头和反复出场的主角而设计
这个生成器的特别之处,归结起来就两点:一条视频能有多长,以及开拍之前你能交给模型多少画面素材。
Scherzo
在上方生成器里做一条视频
从空白表单到成片,一共六步。顺序没那么要紧,参数才是关键,不过按下面的顺序走最快。
登录账号
用你的 Sonata AI 账号登录。每次生成都要消耗积分,先确认余额够不够做你想要的那条视频;在扣除任何积分之前,表单都会先把价格显示出来。
选择起始方式
只有一个想法时选文生视频;手上已经有开场画面时选首帧;需要好几张指定的图片同时出现在画面里时,选参考图。
按需上传图片
首帧模式下,上传开场静帧,想要的话再加一张结尾静帧。参考图模式下,最多上传十张,并且按你打算在提示词里提到它们的顺序上传,因为上传顺序决定了哪张是 Image1、哪张是 Image2。
写提示词
写清楚主体、动作、镜头和光线。输入框最多可以写 5000 个字符,足够把一条长视频里的几个时刻依次交代清楚。提到参考图时,直接写图片的名字。
设置时长、分辨率、比例和声音
在 2 到 30 秒之间选好时长,再选 480P、720P 或 1080P,接着选自适应或固定比例,最后决定音频开关要不要保留。留意生成按钮:调整时长和分辨率时,上面显示的积分会跟着变化。
生成,然后去历史记录
点击生成,等待任务完成。视频会保存在历史记录里,之后随时可以回来找。如果任务失败,积分会自动退回你的余额,可以直接再试一次。
Adagio
长镜头和参考图真正派上用场的地方
在下面这几类项目里,30 秒的时长上限和参考图会带来实实在在的区别。
Adagio
长视频和多张参考图的提示词写法
30 秒的镜头、十张参考图,都值得花一点心思规划。养成下面这些习惯,提示词对模型来说更好理解,对你来说也更好修改。
Coda
Wan 3.0 常见问题
起始方式、参考图、积分、声音和账号,这里一次说清楚。
01应该选哪种起始方式?
只有一个想法时用文生视频。已经有开场画面的镜头适合首帧模式,还可以再加一张结尾画面。参考图模式适合必须出现特定人物、商品或地点的场景,最多可以上传 10 张,并在提示词里逐一点名。
02怎样在提示词里指定某一张参考图?
直接用它的名字。图片按上传顺序编号,第一张是 Image1,第二张是 Image2,依此类推,最多到 Image10。像“Image1 里的女人拿起 Image2 里的马克杯”这样写,比把每张图重新描述一遍清楚得多。
03一条视频要花多少积分,由什么决定?
由时长和分辨率决定。改动其中任何一项,生成按钮上的数字都会随之更新,所以 30 秒的 1080P 视频比 5 秒的 480P 草稿要花得多。开始生成之前,你总能看到具体的积分数。
04生成失败了,积分怎么办?
会自动退回。不需要提交任何申请,积分会回到你的余额里,你可以再试一次,也可以换一段更简单的提示词,或者少用几张参考图。
05可以生成没有声音的视频吗?
可以。声音和画面一起生成,音频开关默认开启。如果打算后期自己加音乐、旁白或音效,生成之前把开关关掉就行。
06画面比例选自适应还是固定比例?
自适应会跟随你的输入素材,上传的图片已经是你想要的构图时最方便。如果视频必须适配某个屏幕或平台,就选固定比例:16:9、9:16、1:1、4:3 或 3:4。
07这个页面和 Wan 2.6、Wan 2.5 页面有什么不同?
它们是不同模型的独立生成器。本站的 Wan 2.6 单条视频最长 15 秒、最高 1080P。这里的限制不一样:单条最长 30 秒,可以加入最多 10 张参考图,声音也有开关。按手头的需要选就好。
08输入有哪些限制?
提示词最多 5000 个字符。首帧模式需要一张开场图,可以再加一张结尾图;参考图模式最多可以上传 10 张。文生视频不需要上传任何图片,只要写好提示词。
09做好的视频在哪里找?
所有结果都保存在你 Sonata AI 账号的历史记录里。同一个想法的 480P 草稿和最终的 1080P 成片放在一处,发布之前可以先对比一下再做决定。
10为什么视频生成失败,或者和预想的不一样?
任务失败时积分会自动退回,所以重试不会多花积分。如果视频生成出来了但效果不对,先检查提示词:参考图的编号是不是写错了,是不是让两个动作在同一时刻发生,或者是不是用一句很短的提示词撑起了很长的时长。
11Sonata AI 和阿里巴巴有关系吗?
没有。Sonata AI 是一个独立平台,与阿里巴巴没有关联,也没有得到阿里巴巴的认可或赞助。Wan 是其所有者的商标,本页提到这个名字,只是为了说明生成器使用的是哪个模型。