Office Mishap AI

An 18-second AI office mockumentary built from three reference images. The chair tips, nobody reacts, one deadpan line lands. Remix it with your cast.

# office-comedy# ai-drama# mockumentary

Domo_1799028

Office Mishap AI:リミックスできるモキュメンタリー・シーン

オフィスで撮られたドキュメンタリー風の18秒コメディです。マネージャーが誰も聞いていない話をしながら椅子を傾けすぎ、同僚はそれを見ていながら手を貸さない。DomoAI のユーザーが、3枚の参照画像 — 彼、彼女、オフィス — から一度の生成で作りました。カメラも撮影クルーもセットもありません。
面白さは「やりすぎないこと」にあります。誰も笑わせにいかず、誰も大げさに驚かない。4秒後にカメラへ向かって放たれる、たった一言の淡々としたセリフで落ちる。この抑えたトーンこそが再利用できる部分です。テンプレートなので、構成もタイミングも4カットの流れもそのままに、椅子に座るキャストだけを自分のものに差し替えられます。

AIオフィス・モキュメンタリーの作り方

ステップ1

Remix を押して参照画像を差し替える

Remix を押すと、このシーンがオムニリファレンスで開きます。3枚の参照画像も、タイミングを含むプロンプト全文も、すでに入った状態です。参照画像にはそれぞれ役割があります。Image 1 と Image 2 が2人の顔・体型・服装を、Image 3 がオフィスそのものを決めます。人物だけを自分のキャストに差し替えて部屋はそのまま使うことも、キャストを残して別の場所に移すこともできます。自分で撮った写真、オリジナルキャラクター、または使用許可のある素材だけを使ってください。

ステップ2

構成は変えず、起きる出来事を変える

残す価値があるのは骨組みです。18秒、4カット、5秒・10秒・14秒でのハードカット、そして最後に本音を言うトーキングヘッド。何が起きるかを差し替えて2行のセリフを書き直しつつ、各ビートには1つのカメラアングルと1つの動作だけを与え、最後のカットはオチのセリフのために取っておきます。すべてを一度に説明する文章より、時間を指定した構成のほうがはるかに安定します。

ステップ3

Audio をオンにして生成する

セリフごとに話者と時間を指定し、その部屋が実際に立てる音 — キーボード、椅子のきしみ、フレーム外での1回の衝撃音 — を書き、音楽は使いません。演技は淡々と。息をのむ音も、飛びかかる動きも、カメラの前で笑う人もなし。まず顔と口の動きを確認し、うまくいった参照画像は残しておきます。次のエピソードでも同じ人物として登場させるためです。

このシーンの制作データ

オムニリファレンス

ワークフロー

3

参照画像

18s

一度の生成で4カット

9:16 · 720P

縦型・音声も同時生成

よくある質問

このオフィスのシーンに自分のキャラクターを使えますか?
はい、そのためのテンプレートです。4カットの構成、タイミング、抑えたトーンは引き継がれ、キャストだけを差し替えられます。それぞれの人物の参照画像を入れ替えれば、同じシーンが自分の登場人物で展開します。自分で撮った写真、オリジナルキャラクター、または使用許可のある素材を使ってください。
セリフは同じ生成に含まれていますか?
はい。このシーンの2行はどちらも、話者と時間を指定してプロンプトに書き込み、Audio をオンにして映像と一緒に生成しました。別途のナレーション収録や吹き替えの工程はなく、字幕も焼き込まれていません。
オフィス以外の場所に変えられますか?
できます。3枚目の参照画像が場所を決めていて、パーティションの配置、ドア、天井の照明、日光が差す方向を制御しています。これをキッチンや教室、店の売り場に差し替えて2人をそのまま残せば、同じ笑いの構造がそのまま使えます。3枚のうち一度に1枚ずつ変えると、どの画像が何を決めているかが分かります。
自分の動画は何秒まで作れますか?
オムニリファレンスは4秒から30秒まで生成できます。このシーンは18秒を4カットに分けています。ショートドラマのビートでは長ければ良いわけではありません。18秒で成立しているのは、どの1秒にも役割があり、カットの切れ目が笑いを運んでいるからです。
解像度とアスペクト比はどうなりますか?
このシーンは9:16の縦型、720Pです。そのままショート動画のフィードに投稿できる形です。オムニリファレンスの出力は480Pまたは720Pで、9:16・16:9・1:1・4:3・3:4に対応しているので、生成前に投稿先に合わせて選べます。
なぜAI動画ではなく本物のドキュメンタリーに見えるのですか?
本物のカメラが持つ「粗さ」をプロンプトで指定しているからです。放送用ドキュメンタリーの質感、やや浅いコントラスト、ニュートラルから緑寄りのオフィスのホワイトバランス、暗部にわずかなノイズ、肌の毛穴が見えること、デジタルシャープネスも美肌処理もなし。カメラは常にわずかに手ぶれを補正し続け、オートフォーカスは一度だけ迷います。この不完全さが本物らしさになり、これを省くと「生成された映像」に見えてしまいます。
撮影したり俳優を手配したりする必要はありますか?
ありません。ここにあるすべては、3枚の静止画と書かれたプロンプトから生まれています。カメラも、撮影クルーも、ロケ地の手配もありません。演技も、椅子の物理挙動も、部屋の環境音も、セリフも、すべて一度の生成で作られています。
1つのシーンをシリーズにするには?
うまくいったときの参照画像を残しておき、次のシーンでもそのまま使います。同じキャスト、違う状況。これがエピソードをまたいで顔を一定に保つ方法で、縦型ショートドラマでいちばん難しい部分です。各話に番号をつけ、状況が完全に解決する前に終わらせてください。

生成・加工・高画質化がワンストップで

もっと探す