AI動画で制作しやすい脚本とは:生成と撮影の制約を踏まえて書く
AI動画でも低予算の実写撮影でも、どんな脚本でも低コストで安定した完成映像にできるわけではない。より確実な方法は、執筆段階で同時に画面に登場する人物の数、長い動作の連続性、場面の変化、小道具とのやり取り、ショットの長さを調整し、安定して制作しにくい内容を音声、インターフェース、テキストノード、再利用できるリアクションショットに置き換えることだ。

はじめに
AI動画でも低予算の実写撮影でも、どんな脚本でも低コストで安定した完成映像にできるわけではない。より確実な方法は、執筆段階で同時に画面に登場する人物の数、長い動作の連続性、場面の変化、小道具とのやり取り、ショットの長さを調整し、安定して制作しにくい内容を音声、インターフェース、テキストノード、再利用できるリアクションショットに置き換えることだ。
本記事では制作に合わせた調整を扱い、特定のモデルの最新性能は評価しない。ツールのバージョンは急速に変わるため、本制作に入る前には、実際に使う予定のショットでテスト映像を作り、モデル、パラメータ、素材の出典、手作業による修正を記録する必要がある。
まずリスクの高い5種類の場面を見極める
複数の人物が長時間同じ画面に映ると、人物の同一性、視線、動作の連続性を保つのが難しくなる。複雑な手の操作、正確な小道具の受け渡し、格闘も、ショットをまたいで一貫性を保つ必要がある。鏡、画面内の文字、制服の標章などの細部は変化しやすい。連続した移動や長回しでは、複数の誤りが1つの素材に積み重なる。頻繁な場面転換は、人物と照明を再構築するコストを増やす。
こうした場面は絶対に制作できないわけではない。ただし、企画段階でテスト、作り直し、手作業のポストプロダクションを見込み、「一度の生成で成功する」という前提で見積もらないことが必要だ。
情報に関わる動作と物理的な動作を分ける
インタラクティブ映像ゲームの緊張感は、情報の変化から生まれることが多く、必ずしも高コストなアクションに頼る必要はない。人物がサーバーをハッキングする場面は、画面上の記録、音声、短いリアクションショット、結果を示す画面で表現できる。キーボード操作を一つひとつすべて見せる必要はない。
『零点回拨』なら、林知夏がイヤホン越しにサーバー室の異音を聞き、同時にインターフェースに入退室管理の変化が表示され、その後に彼女の反応へ切り替える構成にできる。安定した3つの短いショットは、移動、ドアを開ける動作、機器の操作、複数人の会話を含む1つの長いショットよりも、再利用して選択肢につなげやすい。
ただし、すべての動作を文章による説明に置き換えてはいけない。重要な感情と取り返しのつかない行為には、明確な視覚的証拠が必要だ。そうでなければ、プレイヤーは結果が作品の外で起きているように感じてしまう。
分岐に「共通の入口」と「共通の出口」を設計する
各映像区間は、冒頭と末尾の両方で接続を考える必要がある。共通の入口があれば、複数の直前ノードから同じ区間に入れる。共通の出口があれば、異なる選択の後でも滑らかに合流できる。
例えば、選択肢が出る前に、人物が安定した構図の中で中立的な動作のまま止まる。各分岐でそれぞれ短い反応を再生し、その後は同じ位置に戻って共通のショットを続ける。分岐ごとに人物が別の場所へ移動し、異なる小道具を持つと、その後の再利用が難しくなる。
共通の出口で結果を消してはいけない。条件付きの台詞、インターフェースの状態、小道具の変化、次のノードの入口によって違いを残せる。
ショットの制作しやすさを等級化する
| 等級 | 特徴 | 推奨用途 |
|---|---|---|
| A | 1人、ミディアムクローズアップ、短い動作、安定した背景 | 主な台詞と反応 |
| B | 2人の会話、限定的な移動、明確な小道具 | 重要な関係性の場面。先にテスト映像を作る |
| C | 複数人、複雑な動作、厳密な連続性 | 数を減らすか実写合成を使う |
| D | 長い格闘、混雑した場面、複雑な文字と鏡 | 書き直す、ショットを分割する、別の媒体を使う |
脚本のシーン分割表で各ショットに等級を付ける。C、D等級が集中している場合は、制作が失敗するまで待たず、脚本会議で書き直すべきだ。
複数の媒体を組み合わせてコストを抑える
テキストノードは内面の思考、記録、低コストの分岐に適している。静的なインターフェースは証拠の比較に、音声は電話、放送、画面外の出来事に適しており、短い映像は演技と重要な行動を担う。異なる媒体はノードと状態を共有する必要があり、それぞれが別々の物語を形成してはいけない。
媒体を組み合わせる場合も、プレイヤーへの約束を守る必要がある。映画らしい体験を宣伝する作品なら、重要な対立をすべてチャット履歴に縮小してはいけない。調査が中心なら、インターフェースの情報は安価な代用品ではなく、主要なゲームプレイとなる。
AI素材を監査可能な資産として扱う
素材ごとに生成ツールとバージョン、入力素材の出典、プロンプトと参照資料、生成日、手作業による修正、人物と場面のバージョン、使用ノード、ライセンス上の制限を記録する。Steamのコンテンツ調査では、開発段階で生成されてゲームとともに配布されるコンテンツと、実行時に生成されるコンテンツを区別している。正式リリース時には、その時点の規則を再確認し、事実に即して開示する必要がある。
「生成できた」を「使用できる」と考えてはいけない。人物の一貫性、演技の意図、センシティブな内容、第三者の権利、宣伝上の約束も確認する必要がある。
撮影や一括生成の前に3種類のテスト映像を作る
1種類目は最もよく使うショットで、安定した制作能力を検証する。2種類目は最も難しいショットで、最大のリスクを検証する。3種類目は分岐の接続で、区間同士を自然に切り替えられるかを検証する。3種類すべてが合格して初めて、一括制作に進むのが適切となる。
テスト映像の受け入れ確認項目には、人物の同一性、衣装と小道具、照明、視線、口の動きや音声、冒頭と末尾の姿勢、字幕用のスペース、エンコードと組み込みが含まれる。執筆チームは失敗の原因に応じて場面を修正し、修復の負担をすべてポストプロダクションに押し付けないことが必要だ。
一括制作後には、不採用の基準も設ける必要がある。人物の顔や衣装の連続性が保てない、重要な小道具の形が変わる、画面内の文字が読めない、動作の因果関係が不明確、冒頭と末尾のフレームがつながらない場合は、いずれも作り直すか別の媒体に切り替えるべきだ。単体の区間が「格好よく見える」というだけで正式なルートに採用してはいけない。
制作しやすさを考慮した改稿が完了したら、次のモジュールでは選択を正式に検討する。単に2つのボタンを用意するだけでなく、結果を変えるか、代償を求めるか、情報を使うか、人物を表現するかを確認する。


