誰が、または何が映るのかをまず書き、そこに目に見える特徴を2〜3つ足します。年齢、服装、素材、色などです。「青緑のスクラブを着た、疲れた表情の看護師」は「人」と書くよりはるかに多くの手がかりになります。1本の動画に主役は1人に絞ると、視線の集まる場所がはっきりします。
IAllegro
テキストから動画を作るAIジェネレーター
撮りたいショットを文章で書けば、その内容が動画になります。このページではテキストから動画を生成するモデルとしてMiniMax H3・Wan 3.0・Seedance 2.5を切り替えられ、長さ・解像度・アスペクト比を決めて、送信前に必要なクレジットを確認できます。ジェネレーターの下では、モデルに伝わるプロンプトの書き方、ショットに合ったモデルの選び方、少ないクレジットで試す手順を紹介します。
使用モデルMiniMax H3
Andante
3つのモデルの仕様を比べる
設定はすべて上のジェネレーターで行います。選べる範囲はモデルごとに違うので、作りたいショットの条件と照らし合わせて見てください。どの動画にも合う万能のモデルはありません。
- 入力
- 最大5,000文字のテキストプロンプト。基本はテキストから始めますが、画像から始めたいときは最初のフレームや参照画像を追加することもできます。
- モデル
- MiniMax H3、Wan 3.0、Seedance 2.5。このページのモデル選択でいつでも切り替えられます。
- 長さ
- MiniMax H3:4〜15秒。Wan 3.0:2〜30秒。Seedance 2.5:4〜15秒。
- 解像度
- MiniMax H3:768Pまたは2K。Wan 3.0:480P・720P・1080P。Seedance 2.5:480p・720p・1080p。
- アスペクト比
- 16:9・9:16・1:1・4:3・3:4は3モデル共通。21:9はMiniMax H3とSeedance 2.5、アダプティブ(自動)の選択肢はWan 3.0とSeedance 2.5にあります。
- 音声
- MiniMax H3は映像と一緒に必ずステレオの音声トラックを生成します。Wan 3.0とSeedance 2.5は音声をオフにして無音の動画にできます。
- 料金
- クレジットで支払います。生成ボタンの数字はモデル・長さ・解像度を変えるたびに更新されるので、送信前に消費量がわかります。
- 失敗したとき
- 生成に失敗した場合、クレジットは自動で返還されます。
- 保存先
- アカウントの「履歴」に保存されます。生成にはログインが必要です。
Adagio
テキストから動画を作るプロンプトに入れたい6つの要素
動画モデルが頼りにできるのは、あなたが書いた文章だけです。書かなかった部分はモデルが勝手に補い、その想像は頭の中の映像とずれがちです。次の6つを、おおよそこの順番で書いておけば、1ショットに必要な情報はほぼそろいます。
Scherzo
最初の試作から完成版まで
生成のたびにクレジットを使うので、問題は安い試作の段階で見つけ、プロンプトが固まってから長さと解像度にクレジットをかけるのが効率的です。
ログインしてモデルを選ぶ
ログインしたら、ショットに必要な条件でMiniMax H3・Wan 3.0・Seedance 2.5から選びます。どれくらいの長さか、どこまで精細さが要るか、どのアスペクト比か、自動で音を付けたいか。各モデルの範囲は、このページのコンテンツ冒頭にある仕様表にまとめています。
ひとまとまりの文章にする
6つの要素を、被写体から順に数文の平易な文章にまとめます。入力欄には最大5,000文字まで書けますが、数秒の動画に1ページ分の描写は収まりません。見る人が実際に見て、聞くものに言葉を使いましょう。基本はテキストのみで、画像は必要なときだけ加えます。
安い試作を1本出す
モデルで選べるいちばん短い長さと低い解像度を選びます。たとえばWan 3.0やSeedance 2.5なら480P、MiniMax H3なら768Pです。生成ボタンのクレジットが下がるのが確認できます。構図、動き、雰囲気が合っているかを判断するには、試作で十分です。
直すのは1回に1か所
カメラが違うならカメラの文だけを、光が平板ならライティングだけを書き直します。一度に全部変えると、どの修正が効いたのかわからなくなります。結果はすべて「履歴」に残るので、いくつかのバージョンを見比べてから最終的な書き方を決められます。
完成版を生成する
試作がイメージどおりになったら、長さと解像度を上げてもう一度生成します。完成版は新しい生成であって試作の拡大版ではないので、細かな違いは出ます。尺を伸ばすなら、動きにもうひと展開加える必要があるかもしれません。失敗した場合、クレジットは自動で戻ります。
Adagio
用途に合わせてモデルを選ぶ
ここにあるモデルに、何にでも向く一択はありません。完成した動画を何に使うのかを先に決め、その条件に合う範囲を持つモデルを確かめましょう。
Adagio
プロンプトの実例を分解する
このページのために書いた例文と、それぞれの部分をなぜそう書いたのかを順に説明します。まねするのは構成だけにして、言葉はあなた自身の被写体に置き換えてください。
Coda
テキストから動画生成のよくある質問
プロンプト、モデル、クレジット、生成結果についての短い回答です。
01テキストから動画を作るツールは、実際に何をしているのですか?
書かれた説明を読み取り、それにできるだけ沿った短い動画を生成します。被写体、動き、場所、カメラ、そして音声に対応したモデルなら音も含まれます。既存の映像素材を切り貼りしているのではなく新しく生成しているので、プロンプトの言葉選びが結果を大きく左右します。
023つのモデルのうち、どれを使えばいいですか?
順位ではなく、作りたい動画で決まります。15秒より長くしたいならWan 3.0(最長30秒)。21:9が必要ならMiniMax H3かSeedance 2.5。毎回音を付けたいならMiniMax H3が必ずステレオ音声を付けます。無音にしたいならWan 3.0かSeedance 2.5で音声をオフに。2KならMiniMax H3です。
03プロンプトはどのくらいの長さがいいですか?
入力欄には最大5,000文字まで書けますが、1ショットならたいてい3〜6文で十分に描写できます。言葉を増やしても動画の尺は伸びず、数秒の映像で見せられることには限りがあります。プロンプトがどんどん長くなるときは、2つのシーンが混ざっていることが多いので、2回に分けて生成しましょう。
041本の動画に何クレジットかかりますか?
選んだモデル、長さ、解像度によって変わります。設定を変えると必要なクレジットがその場で更新され、送信前に生成ボタンに表示されます。短く低解像度の試作がいちばん少ないクレジットで済むので、お試しに向いています。
05生成に失敗したらどうなりますか?
その生成に使ったクレジットは自動で返還され、申請の必要はありません。失敗の原因としては、プロンプトの内容をモデルが受け付けなかった場合や、モデル側で一時的なエラーが起きた場合が考えられます。同じプロンプトで2回続けて失敗したら、断られていそうな部分を言い換えて再度お試しください。
06書いた内容と違う動画になるのはなぜですか?
よくある原因は、尺に対して動作が多すぎる、カメラの指示が矛盾している、「美しい」「壮大な」のような具体性のない言葉に頼っている、主役が2人いて画面を取り合っている、などです。まず被写体ひとつ・動きひとつまで削って短い試作を出し、そこから細部を足していきましょう。
07生成した動画に音は付きますか?
MiniMax H3なら必ず付きます。どのクリップにも生成されたステレオ音声が入ります。Wan 3.0とSeedance 2.5も音声を生成でき、どちらもオフにする切り替えがあるので、自分の音楽やナレーションを入れたいときは無音の動画にできます。
08テキストではなく画像から始められますか?
はい。このページはテキストが基本ですが、同じページで最初のフレームや参照画像を使うこともできます。商品写真を動かすなど、画像から始める作業が中心なら、上でリンクしている各モデルのページのほうが詳しく説明しています。
09作った動画はどこに保存されますか?
完成した動画はアカウントの「履歴」に保存されるので、あとから見返したり、試作と完成版を見比べたりできます。クレジットと履歴はアカウントにひも付いているため、生成にはログインが必要です。
10Sonata AIはMiniMax、Alibaba、ByteDanceと提携していますか?
いいえ。Sonata AIは独立したプラットフォームで、MiniMax、Alibaba、ByteDanceのいずれとも提携関係はありません。MiniMax H3、Wan 3.0、Seedance 2.5の名前は、ここで使えるモデルを示すために記載しているだけで、各名称はそれぞれの権利者の商標です。