AIモキュメンタリーを作るには、短くコントロールしたクリップをドキュメンタリー風に編集してつなぎます。長い映像を一発でレンダリングするのではありません。繰り返し登場する「インタビュー」対象を作り、トーキングヘッドのクリップを撮り、Bロールを生成して、エディターですべてをつなぎ合わせます。手ブレ、トーキングヘッド、フェイクニュース番組のようなモキュメンタリーのスタイルは、AIが苦手とする部分を覆い隠してくれます。だからこそ、最もリアルに見せやすいフォーマットなのです。
コツは1回の魔法のような生成ではありません。多数の短いクリップ全体での編集とキャラクターの一貫性です。このガイドを読み終える頃には、壊れて見えず意図的に見えるモキュメンタリー短編の、シーンごとに再現できるワークフローが手に入ります。私が実際に使っている流れを、生成ステップにDomoAIを使いながら紹介します。
モキュメンタリーがAI映像に最適な理由
モキュメンタリーは設計上、AIの弱点を隠します。このフォーマットはもともとハードカット、手持ちの構図、カメラ目線で話す人物を前提としています。どれも滑らかでシネマティックである必要はありません。
作り込んだワンショットのレンダリングは欠点をすぐに露呈します。ドキュメンタリー風の編集はその逆です。不完全な構図は「AIのミス」ではなく「本物の映像」として読まれます。スタイルと戦うのではなく、スタイルを味方につけているのです。
ここでのリアルさは2つの要素から生まれます。一貫性と編集です。同じ顔がインタビューやBロールで繰り返し登場することで世界観が成立します。クリップ間のカットが物語を成立させます。解像度は多くの人が思うほど効きません。
繰り返し登場する「キャスト」を固定する
説得力のあるモキュメンタリーは、すべてのシーンで同じ人物を使い回します。だからクリップを1本生成する前にキャストを作っておきましょう。
- 「インタビュー対象」ごとにキャラクター画像を作ります。私は画像編集でNano Banana ProやGPT Image 2を使い、顔・衣装・ディテールを整えて各キャラクターを固定します。
- すべてのリファレンスをアセットパネルに保存します。きれいな正面のポートレート、ミドルショット、表情違いのバリエーションなどです。
- そのリファレンスからキャラクターから動画へ(Move)で各クリップを生成します。元の動きを保ったままキャラクターだけを差し替えるので、同じ人物が複数のシーンに再登場できます。1回の生成は最大30秒で、短いインタビューの回答にちょうど合います。
すべてのクリップで同じリファレンスを使い回しましょう。繰り返し登場する顔こそ、フェイクドキュメンタリーが本物に感じられる最大の理由です。
トーキングヘッドのインタビューを撮る
トーキングヘッドのインタビューはどんなモキュメンタリーでも背骨になります。物語とユーモアを運ぶのです。
リップシンクのセリフにはAIアバターを使います。固定したキャラクター画像と音声をアップロードして、話すクリップを生成します。標準の長さは5秒・10秒・20秒です。30秒と60秒のオプションはProプランのみですが、ここではめったに必要ありません。
台本はモノローグではなく、短いインタビューの一言で書きましょう。短い回答の方がつなぎやすく、各クリップを長さの上限内に収められます。先に音声読み上げ(Text to Speech)で声を生成し、それをそのままAIアバターに入れることもできます。
台本とは別に、動作や表情のプロンプトを加えましょう。わずかな微笑み、うなずき、カメラ外への視線など。こうした小さな仕草が「この人はインタビューを受けている」という感覚を生みます。
Bロールとカットアウェイを生成する
Bロールはトーキングヘッドの合間を埋め、場所を示します。これがないと、短編はポートレートの羅列のように感じられます。
確立ショットやトランジションにはFrames to Videoを使います。2〜8枚のキーフレームを与えて、各ショットの始まりと終わりをコントロールします。生成は1〜56秒で、ほとんどのカットアウェイを余裕でカバーします。
良いモキュメンタリーのBロールには次のようなものがあります。
- 「ロケ地」の外観を示す確立ショット
- インタビューの回答中のリアクションのカットアウェイ
- ナレーターが言及する物やディテールのインサート
- ナレーションが流れる間、歩いたり作業したりする被写体
1枚のフレームからのシネマティックなショットには、画像から動画 / Animate(Seedance 2.0)が強い静止画1枚をカメラの動きと雰囲気のある動くショットに変えてくれます。
短く保ってつなぐ
クリップは設計上短く、それがこの仕事に合っています。長く完璧な1本のレンダリングを期待しないこと。モキュメンタリーは、エディターでつなぎ合わせた多数の短くコントロールされたクリップです。
短いクリップはコントロール・確認・差し替えが簡単です。3秒の悪いカットアウェイは作り直してもほぼノーコストです。90秒の悪いレンダリングはテイク全体を失います。
各インタビューとカットアウェイを別々に生成し、CapCut、Premiere Pro、DaVinci Resolveでカットを組み立てます。一言ずつ並べ、音声の上にBロールを重ね、テンポを整えてトリミングします。映像は単一の生成ではなく、タイムラインの中に存在します。
ドキュメンタリーのレイヤーを足す
最後の仕上げが、本物のドキュメンタリーとして読ませる決め手です。これはエディターで行います。
- インタビューにロワーサード(名前テロップ)と字幕を加える。
- ナレーションを入れる。音声読み上げ(Text to Speech)で生成し、Bロールの下に配置します。
- 少し彩度を落とした手持ち風のグレーディングで、フェイクニュース番組の質感を出す。
- カットの間に控えめな音楽と環境音を加える。
こうした仕上げは手間はわずかでも、リアルさの大部分を担います。字幕とロワーサードだけでも、クリップを「映像素材」として枠づけられます。
FAQ
DomoAIは映像全体を1回の生成で作れますか? いいえ。クリップは意図的に短く設計されています。キャラクターから動画へは1回の生成で最大30秒、Frames to Videoは1〜56秒です。映像は1本の長いレンダリングではなく、エディターでつなぎ合わせた短いクリップとして作ります。
インタビューやシーンをまたいで同じキャラクターを保つには? 各キャラクターをリファレンス画像として固定し、アセットに保存して、すべてのクリップで使い回します。各シーンをキャラクターから動画へで生成すれば、同じ人物が一貫した動きと見た目で戻ってきます。
AI映像をよりリアルに見せるものは? 解像度だけではなく、スタイルと一貫性です。モキュメンタリーのフォーマットは粗さを許容し、繰り返す顔が世界観を成立させ、きれいな編集が物語を成立させます。ドキュメンタリー風のグレーディングとロワーサードは、レンダリング設定を上げるよりリアルさを足します。
長いクリップが短いものより劣化するのはなぜ?どう直す? 長い生成はドリフトします。クリップが長くなるほど顔・手・動きが不安定になります。インタビューは5〜20秒、Bロールは短いカットアウェイで生成し、エディターでつなぐことで直せます。短いクリップなら弱いショットも安く作り直せます。
まとめ
これで再現できるモキュメンタリーのワークフローが手に入りました。繰り返すキャストを固定し、AIアバターで短いトーキングヘッドのインタビューを撮り、Frames to VideoでBロールを生成して、すべてをドキュメンタリー風のカットにつなぎます。リアルさは1本の長いレンダリングではなく、一貫性と編集から生まれます。DomoAIを開いて、最初のインタビュークリップを生成し、シーンごとに短編を組み立てましょう。
