使い方・FAQ

動画シナリオ作成ツールの使い方と、よくある質問。

← ツールに戻る

動画シナリオ作成ツールは、シーンごとに秒数・参照画像・セリフ・カメラワークを決めて、AI動画生成にそのまま貼れる英語プロンプトを作るツールです。タイムラインで尺を確かめながら組み立て、BGM生成用のプロンプトとSRT字幕も書き出せます。

🎬 画面の見方

場所できること
左:プロジェクト画面比率・画風・雰囲気・セリフの言語など、全シーン共通の設定。声・BGM・保存のタブもここにあります
中央:プレビュー画像と字幕とBGMを秒数どおりに再生します。スペースキーでも再生・停止できます
右:インスペクタータイムラインで選んだシーンの中身(画像・映像の説明・セリフ・ショット・カメラワークなど)を編集します
下:タイムライン映像・字幕・BGMの3トラック。クリップを選ぶと編集、右端をドラッグすると長さの変更、ルーラーをクリックするとその位置へ移動します
最下段:プロンプトシーン別・一括・BGM・字幕SRTの4形式で出力し、コピーできます

🖱️ 基本の使い方

  1. 全体の設定を決める。画面比率・画風・色や雰囲気・セリフの言語を選びます。すべてのシーンのプロンプトに共通で入ります。
  2. シーンを並べる。「+ シーン追加」でクリップを増やし、クリップの右端をドラッグして長さを整えます(0.5秒単位)。
  3. シーンの中身を入れる。クリップを選び、右のインスペクターで参照画像・映像の説明・セリフ・ショットやカメラワークを指定します。順番は「← 前へ」「後へ →」で入れ替えられます。
  4. 声を決める。セリフがあるなら、左の「声」タブで話す人ごとに性別・年代・雰囲気を選びます。
  5. プレビューで尺を確かめる。再生して、セリフが読み切れる長さか、カットの切り替えが早すぎないかを確認します。
  6. プロンプトをコピーする。用途に合う形式を選んで、動画生成AIや音楽生成AIに貼ります。

📋 4つの出力形式の使い分け

形式中身向いている使い方
シーン別1シーン=1プロンプト。共通設定も毎回含むので、単体で貼っても意味が通ります1カットずつ生成して、あとで編集ソフトでつなぐ
一括全シーンを [0:00–0:03] のような時間つきで1つにまとめたもの時間の指定を含めて長めに生成できるサービスに貼る
BGMジャンル・雰囲気・テンポ・尺・カットの位置音楽生成AIでBGMを作る
字幕 SRTセリフのあるシーンだけの字幕ファイルYouTubeの字幕アップロード、動画編集ソフトへの読み込み

出力欄の右上の「EN/日本語」で表示する言語を切り替えられます。既定は英語で、日本語は内容を確認するための表示です(選択肢の部分だけが日本語になり、映像の説明やセリフは入力したとおりに出ます)。動画生成AIには英語版を貼るのがおすすめです。

🤖 主な動画生成AIとの組み合わせ方

2026年9月時点の各サービスの仕様と、向いている出力形式の目安です。

サービス1回で作れる長さ音声・セリフ1回で複数カットおすすめの出力
Sora 2(OpenAI)最大15秒(ChatGPT ProはWeb版で25秒)生成できるストーリーボード機能(Pro)シーン別/15秒以内なら一括
Veo 3.1(Google)8秒(シーン延長でつなげる)生成できる1本=1カットが基本シーン別
Seedance 2.0/2.5(ByteDance)2.0=15秒、2.5=30秒生成できるできる(マルチショット)一括
Kling 3.03〜15秒生成できる(日本語対応)できる一括/シーン別
DomoAI5秒・10秒映像のみ1本=1カットシーン別+SRT字幕

長さの上限や機能はプランや更新で変わります。使う前に各サービスの最新情報を確認してください。

✍️ 伝わるプロンプトにするコツ

指示の出し方で結果がどう変わるかは、記事「AI動画生成は指示の出し方で9割決まる|DomoAIで6本検証」で実際に生成して比べています。

❓ よくある質問

どの動画生成AIで使えますか?

特定のサービスの記法に依存しない汎用の英語プロンプトを出力するので、Sora・Veo・Seedance・Kling・DomoAIなど、テキストで指示を受け付ける動画生成AIであれば使えます。1カットずつ生成するサービスには「シーン別」、1回で複数カットを長めに生成できるサービスには「一括」が向いています。サービスごとの目安は「主な動画生成AIとの組み合わせ方」の表を参照してください。

映像の説明は日本語で書いてもいいですか?

書けますが、自由記述の欄は入力した言語のまま出力されます。ショットやカメラワークなどの選択肢は英語に変換されるので、映像の説明も英語で書くとプロンプト全体が英語でそろい、意図が伝わりやすくなります。セリフは話してほしい言語のまま書いてください。

1シーンは何秒にすればいいですか?

1回の生成で作れる動画の長さは、サービスやプランごとに上限が決まっています。使うサービスの上限に合わせてシーンを分けてください。10秒を超えるシーンがあるとツールが注意を表示します。

声の性別や年代は指定できますか?

できます。左の「声」タブに、シーンに登場する話す人が自動で並びます。話す人ごとに性別・年代・雰囲気・話す速さと補足を選ぶと、その人のセリフの行に声の指定が入ります(例: a calm, middle-aged male voice)。話す人が空欄のセリフはナレーションとしてまとめて設定できます。

参照画像はどう使われますか?

画像を指定したシーンのプロンプトには「添付した参照画像を使う」という一文が入ります。画像そのものはプロンプトに含まれないので、動画生成AIに貼るときに同じ画像を添付してください。プレビュー再生ではその画像が表示されます。

SRT字幕は何に使えますか?

セリフのあるシーンだけを、シーンの開始・終了時刻つきの字幕ファイルにします。YouTubeの字幕アップロードや、SRTの読み込みに対応した動画編集ソフトでそのまま使えます。

BGMの音源ファイルはどう使われますか?

プレビュー再生で映像と一緒に流すためだけに使い、プロンプトには含めません。BGMタブのプロンプトは、ジャンル・雰囲気・テンポと動画の尺・カットの位置から作るので、音楽生成AIに貼ってBGMを作るときに使えます。

入力した内容や画像はサーバーに送信されますか?

送信されません。入力内容・画像・音源はすべてお使いのブラウザの中(IndexedDB)に自動保存されます。別の端末へ移すときは「保存」タブからJSONで書き出してください。JSONには画像と音源は含まれません。

🔗 関連ツール

← ツールに戻る