メインコンテンツへ移動

テキストから動画を作るAI

見たいものを文章で書けば、映像になって返ってきます。カメラもストック素材もタイムラインも不要。必要なのはプロンプトとモデル、そして公開先に合わせたアスペクト比だけです。

  • プロンプトから完成クリップへ
  • ショットごとにモデルを選べる
  • 繰り返し使えるキャラクター
  • 縦型・正方形・横長に対応

テキストを動画にする方法

仕事の大半はプロンプトが担います。この3ステップがすべてで、品質の差が生まれるのはたいてい2つ目のステップです。

  1. 01

    物語ではなく、ショットを書く

    ひと続きのショットを描写します。被写体、その動き、カメラワーク、照明、スタイル。出来事の連続を描いたプロンプトは、それを全部こなそうとして、どれも中途半端なクリップになります。

  2. 02

    モデルと出力形式を選ぶ

    動き、顔、スタイライズなど、ショットに合った強みを持つモデルを選び、長さとアスペクト比を設定します。フォームにはそのモデルが対応する組み合わせだけが表示されます。

  3. 03

    生成し、確認し、改善する

    生成はバックグラウンドで実行されるので、同じプロンプトのバリエーションをキューに入れ、1本ずつ待つことなくライブラリで並べて比較できます。

テキストからの動画生成を使えるものにするもの

プロンプトのガイドを内蔵

入力画面にはモデル固有のプロンプト文字数の上限が表示され、モデルがよく無視する部分も指摘されます。クレジットを使ったあとではなく、使う前に気づけます。

一貫したキャラクター

保存したキャラクターをプロンプトで指定すれば、すべてのクリップに同じ顔が登場します。バラバラなショットの寄せ集めか、ひとつのコンテンツとして伝わるシリーズかの違いはここにあります。

書き直し不要のモデル切り替え

モデルを変えてもプロンプト、参考画像、設定は引き継がれます。同じアイデアで2つのモデルを比べるのに、作り直しは不要。クリックひとつです。

複数のバリエーションをキューに

生成中もページはブロックされません。同じショットを3通りの言い回しで送信し、作業を続け、届いたらまとめて見比べられます。

その場で仕上げる

2Kや4Kへのアップスケール、別のアスペクト比へのリフレーム、少し早く終わってしまうクリップの延長。先に別ツールへ書き出す必要はありません。

音声も同じページで

オーディオスタジオで生成したナレーション、音楽、効果音を追加できます。クレジットもライブラリも共通です。

テキストからの動画生成が向いている場面

存在しないシーン

撮影できない場所、映像のないコンセプト、スタイライズされた世界。そもそも撮るものが何もない場合に。

フックとオープニング

ショート動画の冒頭3秒。注目をつかめるものが出るまで、十数通りのバリエーションを生成できます。

絵コンテと提案

撮影の予定や手配をするずっと前に、シーケンスの意図をクライアントに見せられる動く絵コンテ。

Bロールとカットアウェイ

既存の編集のルックに合わせたつなぎのショットを、タイムラインが必要とするちょうどの長さで生成します。

スタイライズした解説動画

スライドやストック映像では平板に見えてしまうコンセプトを、抽象的・イラスト的な動きで表現します。

広告のバリエーション

同じメッセージを何通りもの撮り方で。2日目の撮影なしに、キャンペーンで複数のクリエイティブをテストできます。

モデルに負けないプロンプトの書き方

テキストからの動画生成で期待外れの結果になる原因の多くは、ショットではなくシーンを求めるプロンプトです。4〜12秒を生成するモデルには、出来事の連続を語ることはできません。できるのは、ひと続きの瞬間を説得力をもって保つことです。被写体をひとつ、動作をひとつ、カメラの動きをひとつ、そして照明条件を指定したプロンプトは、小さな映画を描写したプロンプトよりも一貫して良い結果になります。

もうひとつ身につけたい習慣は、物語ではなくフレームについて具体的に書くことです。「窓辺のセラミックのマグにゆっくりドリーイン、朝の逆光、浅い被写界深度」と書けば、モデルに解くべき構図が与えられます。「居心地のいい朝のシーン」では手がかりが何もなく、生成のたびに結果が違う方向へずれていくので、改善の試行が狙ったものではなく運任せに感じられます。

最後に、一貫性はプロンプトの問題ではなく準備の問題として扱いましょう。同じ人物、商品、スタイルを複数のクリップに登場させる必要があるなら、キャラクターや参考画像として一度保存し、それを指定します。顔を言葉で説明し直しても、どれほど丁寧に書いても毎回違う顔になります。言葉はアンカーではないからです。アンカーになるのは参考画像です。

テキストから動画に関するよくある質問

テキストからの動画生成は無料ですか?
はい、無料クレジットの範囲内で無料です。すべてのアカウントに、動画・画像・オーディオの生成に使えるクレジットが付与され、使うのにカードは不要です。有料プランでは、クレジットの追加、高解像度、透かしなしの書き出しが利用できます。
生成にはどのくらい時間がかかりますか?
モデル、長さ、プロバイダーの混雑状況によりますが、ほとんどは1〜3分で完了します。生成はバックグラウンドで実行されるので、さらにプロンプトをキューに入れたり、タブを閉じてあとで結果を確認したりできます。
複数のクリップで同じキャラクターを保てますか?
はい。自分の写真からキャラクターを保存し、各生成で指定してください。シリーズを通してひとつの顔を保つ確実な方法です。同じ人物を言葉で説明すると、生成のたびに別人になってしまいます。
生成できる長さとアスペクト比は?
長さは一般的に1クリップあたり4〜12秒で、モデルに応じて9:16、1:1、4:5、16:9が利用できます。利用可能な組み合わせは送信前にフォームに表示されます。
生成結果を商用利用できますか?
はい。利用規約に基づき、有料プランで商用利用できます。プロンプトに入れる内容についてはお客様の責任となります。特に、本人の同意なく実在の人物の肖像を生成しないでください。

同じスタジオへのほかの入り口

プロンプトを試して、何が返ってくるか見てみよう

登録時に無料クレジット。カタログのすべてのモデルが使え、結果は作業を続けられるライブラリに届きます。