AI動画が指示を無視する理由:動作を1つに絞る

「One Clear Action」の文字の横で、白いマグカップを持つ手。

画像から動画のプロンプトは、ショットに明確な主動作を1つ与えると機能しやすくなります。短い動画に5つの変化を求めると、モデルは混ぜる、順序を変える、途中で終える場合があります。中心の出来事を1つ決め、髪、布、光、カメラの動きは補助にします。

動詞を1つだけ使うという意味ではありません。見る人が「このショットは主に何を見せているか」に答えられる状態を目指します。

プロンプトは指示であり、ショットの時間軸ではない

元画像はすでに被写体、構図、照明、開始状態を定義しています。プロンプトには最初のフレームの後に何が変わるかを書きます。

そのため「カフェにいる女性」だけでは動きの指示がほとんど増えません。女性とカフェは画像にすでに写っています。

「女性がコーヒーカップを唇まで持ち上げる」なら、画像から動画に目に見える出来事を伝えられます。

プロンプトは、各動詞を手動の正確な時間軸に配置するものではありません。DomoAIは元画像、プロンプト、モデル、長さ、設定から動画を生成します。

長い動作一覧は同時動作として解釈されることがあります。最初の動作だけ終え、残りの時間がなくなる場合もあります。

次の3点を中心に書きます。

  1. 固定する被写体:同じ姿を保つ人物、商品、物体。
  2. 主動作を1つ:見る人が気づく物理的変化。
  3. 場面・カメラの補助:主動作と競合せず、読み取りを助ける動き。
自転車に関する5つの競合動作と、ヘルメットをかぶる1つの明確な動作を比較した図。

開始・動作・終了で組み立てる

テーブル上のコーヒーカップ、持ち上げる途中、女性の唇に届いた状態を示す3フレーム。

書く前にショットを3行で整理します。

  • 開始:画像にすでに何が写っているか。
  • 動作:どんな物理的出来事が1つ起きるか。
  • 終了:どの状態になれば動作が完了するか。

コーヒーのショットなら次のとおりです。

  • 開始:カップは女性の右手の横、テーブル上にある。
  • 動作:女性がカップを口へ持ち上げる。
  • 終了:縁が唇に届き、女性が止まる。

プロンプトは次のようになります。

固定したミディアムショット。女性は右手を伸ばし、白いコーヒーカップをテーブルから持ち上げ、
縁を唇へ運ぶ。肘は一続きの動きで曲がる。カップが口元に届いた状態で止まる。
湯気が上がり、ほどけた髪がわずかに動く。カメラ左から暖かな窓明かり。
5秒、16:9。手ぶれ、余分なカップ、手の変形、文字、ウォーターマークなし。

「手を伸ばす、持ち上げる、運ぶ」は、1つの物体操作の段階です。主な出来事はカップを持ち上げて飲むことです。

次のような無関係な状態の連続と比べてください。

女性はコーヒーを持ち上げて飲み、立ち上がって窓へ歩き、振り返って笑い、カップを置く。

これは短い1クリップで場面全体を演じる指示です。形容詞を増やす前に分割してください。

人物の動き:悪い例から改善例へ

体の変化を1つと、その終点を書くと人物プロンプトは明瞭になります。

悪い例改善例改善する理由
男性が歩き、手を振り、振り向き、座る。男性はカメラへゆっくり2歩進み、両足を見せたまま止まる。4つの展開を1つの経路と明瞭な終点に置き換える。
ダンサーが美しく劇的に動く。両腕を肩の高さから頭上まで上げ、最後のポーズを保つ。抽象的な雰囲気ではなく関節の経路を示す。
少女が周りを見て走り去る。体を静止させたまま、頭を左から右へ向ける。頭の回転だけに絞り、走る動作は次のクリップへ移す。

自然な補助動作は消しません。髪は回転に反応し、布は腕を上げた後に落ち着けます。

補助動作は別の展開になるのではなく、主動作を支える必要があります。

商品の動き:悪い例から改善例へ

商品には制御された移動経路が必要です。回転、開封、変形、文字表示を同時に求めないでください。

悪い例改善例改善する理由
ボトルが回り、開き、飛び散り、花に変わる。ボトルは台上で時計回りに90度回転し、正面ラベルをカメラへ向けて止まる。測定できる1経路と明確な向きになる。
靴を躍動的で高級に見せる。カメラをテーブルの高さに固定し、靴を15度上へ傾ける。ブランド表現を見える動きに替える。
箱が開き、中身が全部飛び出す。箱の後ろの蝶番を軸に蓋を垂直まで上げ、箱本体は固定する。蓋だけを動かし、商品本体を固定する。

最終価格、法的表示、正確な商品文は編集ソフトで追加します。小さな生成文字は動作中に正確さを保てない場合があります。

元画像の商品形状が誤っているなら、先に静止画を直します。動作プロンプトに包装形状の修復まで任せないでください。

カメラの動きには役割を1つ与える

カメラ移動は被写体を支えることも、競合することもあります。1ショットにつき1つの意図から始めます。

悪い例改善例改善する理由
左へパンし、ズームし、周囲を回り、後退する。被写体を静止させ、ミディアムから寄りへゆっくり押し込む。1つのカメラ経路で構図の変化が読める。
映画的なカメラ移動。腰の高さの固定カメラが自転車と同じ速度で横移動する。方向、高さ、被写体との関係が明確になる。
車が加速し、カメラがあちこち動く。車が加速する間、後方カメラをバンパー高、車の60cm後ろに保つ。カメラ位置が主動作と結び付く。

被写体の動きが複雑ならカメラを固定します。静かなカメラは手と物体の接触を読みやすくします。

本当に別々のカメラ動作が必要な場合だけ時間区分を使います。タイムコードで無関係な5つの動作を隠さないでください。

顔の動きは見える変化で書く

「もっと感情的に」だけでは顔のどこを動かすか分かりません。単純な表情変化を書き、頭の動きは控えめにします。

悪い例改善例改善する理由
女性が感情豊かになる。カメラを見たまま、無表情から口を閉じた小さな笑顔へ変わる。表情の開始と終了が明確になる。
男性が驚き、笑い、泣き始める。画面外の音へ向くとき、眉を上げ、目を見開く。競合する3感情を1反応に替える。
自然な顔の動き。肩を動かさず、1回まばたきして顎を少し下げる。つながる2つの微動作を示す。

寄りのプロンプトは特に狭くします。顔が画面を占めると小さな変化も大きく見えます。

物体との接触を明示する

物体操作は、手が触れる、持ち上げる、離す瞬間に壊れやすくなります。接触を物理的な順序で書きます。

悪い例改善例改善する理由
電話を使って片付ける。右手で電話を握り、机から持ち上げ、胸の高さで保つ。握りと経路を1操作に収める。
ランタンで遊び、飛ばす。両手を開き、頭上で光るランタン1つを離す。物体数と離す位置を固定する。
ライダーが準備して走り去る。両手でヘルメットを持ち上げ、頭へ下ろす。「準備」を1つの見える動作にする。

物体数や接触が重要なら「1つ」「右手」「左手」を使います。具体的な名詞は雰囲気の形容詞より役立ちます。

完全な動作プロンプトを1つ作る

短いことは曖昧という意味ではありません。物理的な動き、カメラ、光、長さ、構図、安定条件を含めても焦点は保てます。

ヘルメットをかぶる動作—固定縦位置

同じ自転車の横に同じ人物が立つ元画像と一緒に、画像から動画へへ貼り付けます。

胸の高さ、被写体から3mの3/4カメラを固定。からし色のレインジャケット、
濃灰色パンツ、白いスニーカーの同じ成人サイクリスト。同じ銀色ロードバイクの横で、
つや消し黒のヘルメットを1つ持つ。両手で持ち上げ、頭へ下ろし、装着後に手を離す。
顎ひもが1回揺れて止まる。自転車は静止。早朝、カメラ左から柔らかな琥珀色の光。
5秒、9:16。手ぶれ、人物のずれ、自転車の動き、余分なヘルメット、手の変形、文字、
ウォーターマークなし。

被写体部分は人物と小物を固定します。主動作はヘルメットをかぶること、ひもの動きはその補助です。

自転車を動かすと2つ目の展開になるため、静止させます。

原因を1つずつ修正する

意図と違う結果が出たら、すべてを書き直す前に見える失敗を診断します。

見える問題最初の修正
主動作が始まらない抽象的な動詞を物理的な動きに替える。
始まるが終わらない経路を短くするか、時間を増やす。
2つの動作が混ざる重要な方だけ残し、もう一方を別ショットへ移す。
カメラが動作を隠す固定するか、単純な1移動に減らす。
小物が複製される数を指定し、説明を変えない。
元画像の手や物体が壊れている動画を再生成する前に画像を修復する。

動いている部分は残します。動作が明瞭でカメラだけ動きすぎるなら、カメラの行だけ変えます。

対応ツールではAI Optimizeで短いプロンプトを展開できます。出力を下書きとして扱い、主動作と競合する動作や細部を削除します。

全体構造とカメラ表現はDomoAIのAI動画プロンプトガイドも参照してください。

1枚の画像では足りない場合

新しい動作、場所、カメラ位置、被写体状態が必要なら別ショットにします。ヘルメットをかぶる、自転車を持ち上げる、走り去る動作を3本に分けます。

1つの画像から動画プロンプトを隠れた絵コンテにしないでください。

既知の見た目の状態を連続動作で通る必要があるなら、Frames to Videoを使います。開始、中間、終了画像を指定するワークフローです。

違いは簡単です。1枚の画像ではモデルが到達点を考え、複数フレームでは動画が到達すべき瞬間を指定します。

画像から動画のプロンプトに関する質問

AI動画がプロンプトの一部を無視するのはなぜですか?

すべての動作を行う時間や明確な優先順位がない可能性があります。主動作を1つ残し、後の展開は別ショットに移します。

画像から動画のプロンプトに複数の動作を入れられますか?

小さな動きが1つの出来事を支えるなら可能です。カップを持ち上げて肘を曲げる動作は一続きですが、立つ、歩く、座るは別の展開です。

短いプロンプトほどよい動画になりますか?

必ずしもそうではありません。短くても曖昧な場合があります。主動作、物理的方向、見える終点を明確にしてください。

同じプロンプトでも結果が変わるのはなぜですか?

生成ごとに差があります。修正時は元画像と設定を固定し、変更した1点を判断できるようにします。

先にモデルを変えるべきですか、それともプロンプトを書き直すべきですか?

選んだモデルが必要な長さと制御に対応するか確認します。対応するなら、複数設定を変える前に見える動作を修正します。

明確な動作1つは万能な公式ではなく、ショットの指示、確認、修正をしやすくする方法です。

画像から動画を開き、最初の動きを物理的な変化として書いてください。

最新の記事