長さは2秒から30秒まで、1秒刻みで指定できます。30秒あれば、ひとつの場面を最後まで描けます。料理人が最初の食材を置いてから盛り付けを仕上げるまで、カメラが店内をゆっくり進んでいく様子、人物がフレームに入ってきて反応するまで。短いクリップを何本もつなぐ必要はありません。
IAllegro
Wan 3.0 動画ジェネレーター:長めのカットと参照画像
Wan 3.0は、AlibabaのWanシリーズに属する動画モデルです。シーンをじっくり見せたいとき、同じ人物や同じ商品を最初から最後まで見分けられる形で登場させたいときに向いています。プロンプトだけ、最初のフレームになる画像、または最大10枚の参照画像から始められ、長さは2〜30秒の範囲で自由に決められます。このすぐ下の生成フォームからそのまま作成できます。
使用モデルWan 3.0
Andante
Wan 3.0の仕様と上限
このモデルで設定できる項目をひとつの表にまとめました。クレジットを使う前に、どんなカットにするか計画するときの目安にしてください。
- 開始方法
- テキストから動画/最初のフレーム(最後のフレームも任意で追加可)から動画/参照画像から動画
- 動画の長さ
- 2〜30秒の範囲で、1秒単位の任意の秒数
- 解像度
- 480P、720P、1080P
- アスペクト比
- アダプティブ(入力に合わせる)、16:9、9:16、1:1、4:3、3:4
- 参照画像
- 最大10枚。アップロード順にImage1、Image2…としてプロンプト内で呼び分けられます
- 音声
- 映像と一緒に生成。音声トグルは初期状態でオンになっており、オフに切り替えられます
- プロンプトの長さ
- 最大5,000文字
- クレジット
- 長さと解像度に応じてリアルタイムで変わり、生成ボタンに表示されます。生成に失敗した場合は自動で返還されます
- アカウントと保存先
- Sonata AIアカウントでのログインが必要。完成した動画は履歴に保存されます
Adagio
長いカットと、繰り返し登場する被写体のために
この生成フォームならではの点は、突き詰めると二つです。1本の動画をどこまで長くできるか、そして生成前にどれだけの画像素材をモデルに渡せるか、です。
Scherzo
上の生成フォームで動画を作る手順
空のフォームから完成した動画まで、6つのステップです。順番よりも設定の中身が大事ですが、この流れで進めるのがいちばん早く済みます。
ログインする
Sonata AIのアカウントでログインします。生成にはクレジットを使うので、作りたい動画に足りる残高があるか確認しておきましょう。クレジットが引かれる前に、フォームに必要な量が表示されます。
開始方法を選ぶ
アイデアしかないならテキストから動画、冒頭の画像がすでにあるなら最初のフレーム、特定の画像を何枚かシーンに登場させたいなら参照画像を選びます。
必要に応じて画像を追加する
最初のフレームを使う場合は、冒頭の静止画をアップロードし、必要なら最後の静止画も加えます。参照画像の場合は最大10枚まで、プロンプトで触れる順番にアップロードしてください。その順番でImage1、Image2…が決まります。
プロンプトを書く
被写体、動き、カメラ、光を書きます。入力欄には最大5,000文字まで入るので、長い動画の中で起きる出来事を順番に並べるのにも十分です。参照画像に触れるときは、画像の名前を使いましょう。
長さ・解像度・比率・音声を設定する
長さを2〜30秒から選び、解像度を480P、720P、1080Pから選び、アダプティブか固定の比率を決め、音声トグルを残すかどうかを決めます。長さや解像度を変えると、生成ボタンに表示されるクレジットも変わるので確認してください。
生成して、履歴を開く
生成ボタンを押し、処理が終わるのを待ちます。動画は履歴に保存されるので、あとからいつでも見返せます。失敗した場合はクレジットが自動で残高に戻るので、そのままやり直せます。
Adagio
長いカットと参照画像が役立つ場面
30秒という長さと参照画像が、実際に差を生むプロジェクトの例です。
Adagio
長尺と複数の参照画像を活かすプロンプトのコツ
30秒のカットも、10枚の参照画像も、少し準備するだけで扱いやすくなります。次のような書き方を習慣にすると、モデルにも伝わりやすく、あとで直すのも楽になります。
Coda
Wan 3.0 よくある質問
開始方法、参照画像、クレジット、音声、アカウントについて簡単にお答えします。
01どの開始方法を選べばいいですか?
アイデアだけがあるなら、テキストから動画が向いています。冒頭の画像がすでに決まっているカットなら最初のフレームを使い、必要なら最後の画像も加えられます。特定の人物や商品、場所を必ず登場させたいシーンには参照画像が合っています。最大10枚までアップロードでき、それぞれを名前で指定できます。
02プロンプトで特定の参照画像を指すにはどうすればいいですか?
画像の名前を使います。画像はアップロードした順に番号が付き、1枚目がImage1、2枚目がImage2となり、最大でImage10までです。「Image1の女性がImage2のマグカップを手に取る」のように書けば、画像ごとに見た目を説明し直すよりずっと明確です。
031本あたりのクレジットは何で決まりますか?
長さと解像度です。どちらかを変えると生成ボタンの数字がすぐに更新されるので、1080Pで30秒の動画は、480Pで5秒の下書きより多くのクレジットを使います。生成を始める前に、必ず具体的な数字を確認できます。
04生成に失敗したら、クレジットはどうなりますか?
自動で返還されます。申請などの手続きは不要で、クレジットは残高に戻ります。そのまま再挑戦するか、プロンプトを簡単にする、参照画像を減らすといった調整をしてから試してください。
05音声なしの動画は作れますか?
作れます。音声は映像と一緒に生成され、トグルは初期状態でオンになっています。あとから自分で音楽やナレーション、効果音を付ける予定なら、生成する前にオフにしてください。
06アスペクト比はアダプティブと固定のどちらがいいですか?
アダプティブは入力に合わせるので、アップロードした画像の構図をそのまま使いたいときに便利です。特定の画面やフィードに合わせる必要があるなら、16:9、9:16、1:1、4:3、3:4のいずれかの固定比率を選んでください。
07Wan 2.6やWan 2.5のページとは何が違いますか?
それぞれ別のモデル用の、独立した生成ページです。このサイトのWan 2.6では、最長15秒、最大1080Pの動画を作れます。このページは上限が異なり、最長30秒、参照画像は最大10枚、音声のオン・オフの切り替えにも対応しています。用途に合うほうを選んでください。
08入力にはどんな制限がありますか?
プロンプトは最大5,000文字です。最初のフレームを使うモードでは冒頭の画像が1枚必要で、最後の画像を1枚追加することもできます。参照画像モードでは最大10枚までアップロードできます。テキストから動画では画像は不要で、プロンプトだけで始められます。
09完成した動画はどこで見られますか?
すべての結果は、Sonata AIアカウントの履歴に保存されます。同じアイデアの480Pの下書きと1080Pの完成版が一か所にまとまるので、公開前に見比べてから決められます。
10生成に失敗したり、思った通りにならなかったりするのはなぜですか?
失敗した場合はクレジットが自動で戻るので、やり直しても余分なクレジットはかかりません。動画はできたもののイメージと違う場合は、まずプロンプトを見直しましょう。参照画像の番号を書き間違えていないか、同じ瞬間に二つの動作を求めていないか、とても短いプロンプトで長い秒数をまかなおうとしていないか、を確認してください。
11Sonata AIはAlibabaと関係がありますか?
ありません。Sonata AIは独立したプラットフォームで、Alibabaとの提携関係はなく、Alibabaから承認やスポンサーを受けてもいません。Wanはその所有者の商標であり、このページでは生成フォームがどのモデルを使っているかを示すためにのみ名前を記載しています。