動画機能ガイド

Gemini Omni動画入力ワークフロー

各参照素材が何を制御するかを決めて、テキスト、画像、音声、元動画を設計します。

場面と動作
テキスト
外観と構図
画像
声とリズム
音声
動きと編集元
動画

入力タイプ別にワークフローを見る

言葉だけでショットを構築

被写体、場所、動き、カメラをゼロから作りたい場合に使います。

有効な入力
被写体と動作
環境と照明
カメラ移動
比率とテンポ

各入力に1つの責任を持たせる

参照が多いほど良いとは限りません。役割を明確にすると矛盾を防げます。

テキストは意図

動作、物語、カメラ、除外事項、納品形式を言葉で定義します。

画像は外観

人物、商品詳細、衣装、構図、スタイルを高品質な画像で固定します。

音声はリズム

対応ワークフローでは、声、音楽、時間、感情のテンポを音声で示します。

動画は動き

動き、時間、編集、延長、テキストでは伝えにくい動作を元動画で示します。

複合リクエストを設計

生成キューに入る前に指示の競合を解決します。

完成像を書く

完成動画が伝えることを1文で書きます。

参照の役割を決める

各ファイルが制御するものと、変えてはいけないものを指定します。

保持ルールを追加

人物、商品形状、ロゴ、カメラ軸、時間で固定する部分を明示します。

最短の下書きを確認

大きなバッチの前に短尺で方向を検証します。

入力品質チェック

整理された入力は、長いプロンプトより有効なことがあります。

鮮明で明るい参照画像
必要な動作だけに動画を切る
競合するスタイルを避ける
各入力の役割を書く
主要カメラ指示は1つ
素材の利用権を確認する

Gemini Omni動画のよくある質問

最初にどの入力を使うべきですか?

自由な探索はテキスト、見た目の一貫性は画像、声やテンポは音声、既存の動きや時間は元動画を使います。

すべての入力を組み合わせるべきですか?

いいえ。結果の明確な部分を制御する入力だけを追加してください。多すぎる参照は矛盾を生みます。

人物の一貫性を高めるには?

明確な人物参照を使い、競合する顔や衣装を避け、固定する要素を書き、毎回1つだけ変更します。

AIの出所表示を削除できますか?

本サイトはSynthID、C2PA、透かし削除を提供しません。必要な表示と出所情報を保持してください。