ブログに戻る
2026年8月26日OpenVideoMaker Team更新日 2026年8月26日

Veo 3.1 AI動画生成器の使い方

Google Veo 3.1で映画的なプロンプト、参照画像、カメラワーク、音声、高解像度のAI動画を作る方法を解説します。

Google Veo 3.1 AI動画生成器を使うときは、短く焦点を絞ったショットの概要を書き、カメラの動きを明確にし、音声を後付けではなくシーンの一部として扱います。映画的なクリップ、商品ビジュアル、動きと音、高解像度を同時に重視する場合にVeo 3.1が役立ちます。

OpenVideoMakerにはVeo 3.1とVeo 3.1 Fastがあります。標準版は仕上げを重視した生成に向き、Fastはコンセプトを素早く試すときに便利です。参照画像、アスペクト比、解像度、長さ、音声の設定も選べるため、公開先に合わせて調整できます。

Veo 3.1でAI動画を作る方法

1. プロンプトを書く前にショットを決める

被写体、環境、カメラ位置、主な動作、雰囲気、用途を決めます。商品紹介、風景の導入ショット、SNS広告ではテンポと構図が異なります。最初のプロンプトは一つの見える動作に絞ると、Veoが概要を理解したか判断しやすくなります。

2. カメラの動きを自然な言葉で書く

「ミディアムからクローズアップへゆっくりドリーイン」「固定のワイドショット」「テーブルの上をゆっくりクレーンダウン」のように書きます。カメラの指示は、それが支える動作の近くに置きます。被写体がカメラに向かって歩く場合は、カメラを固定するのか、後退して追うのか、周囲を回るのかを説明します。

3. シーンに音が必要なら音声を指示する

Veo 3.1は雨、部屋の環境音、足音、会話、穏やかなアンビエント音楽などを解釈できます。「静かなカフェの環境音、テーブルにカップを置く音、その後に短い台詞」のように、音と動作の関係を書きます。生成後は音声も別に確認してください。映像がよくても、用途に合う音が必要です。

4. 一貫性が重要なら参照画像を加える

商品、キャラクター、環境を視覚的に固定したいときは、最大3枚の参照画像をアップロードできます。重要な被写体が見える明瞭な画像を使います。Veoの参照モードは8秒の長さを使うため、長い動画より視覚的な基準が重要な場合に選びます。

5. バリエーションと出力設定を選ぶ

仕上げを重視する場合はVeo 3.1、素早く探索する場合はVeo 3.1 Fastを選びます。生成前に比率、解像度、長さ、音声を設定します。Veoは720pから4Kまで対応しますが、最適な選択は公開先で決まります。SNS用の下書きに最大設定が必要とは限りません。

6. 映像と音を一緒に確認する

最初のフレーム、主なカメラワーク、被写体の一貫性、動作のタイミング、音声の同期を確認します。一つの部分だけが失敗したら、その部分だけプロンプトを変更します。構図がずれる場合はカメラ指示を短くし、主な動作が終わらない場合は二次的な動作を削除します。

Veo 3.1のプロンプト構成

次の順番でプロンプトを組み立てます。

  • ショットとカメラ:構図、レンズの印象、動き。
  • 被写体:身元、素材、服装、商品特徴。
  • 動作:一つの主な動きと終了状態。
  • 環境:場所、時間、天気、背景の動き。
  • 光とスタイル:光源、コントラスト、色、仕上がり。
  • 音声:会話、効果音、環境音、音楽。

例:「日の出の木製デスクに置かれたマットブラックのトラベルマグへ、ゆっくりドリーインする。手が入り、マグを持ち上げると、暖かな窓明かりの中で湯気が渦巻く。クリーンな商用写実、浅い被写界深度、柔らかな部屋の環境音、机に陶器が軽く触れる音、他の物体は動かさない。」被写体、動き、カメラ、見た目、音を示し、競合する物語を避けています。

商品とSNS動画にVeo 3.1を使う

商品動画では素材、形、表面の反射、見せたい一つの商品の動作を説明します。ゆっくり回転する、蓋を開ける、布が動く、近づいて見せるといった動作は、複数のやり取りを一度に生成するより確認しやすくなります。正確な商品を維持したい場合は、きれいな商品参照を使います。

SNS用動画では生成前に比率を選び、被写体をセーフエリアに収めます。縦型ショートと横型Webヒーローでは構図が違います。長すぎる場合は動画トリマーで切り、プラットフォーム用のサイズが必要なら動画リサイザーを使います。

Veo 3.1と他のAI動画モデルの違い

映画的なカメラ表現、音声の指示、高解像度が中心ならVeoを選びます。物語のあるシーンとキャラクターにはSora 2、参照を多く使う動きにはSeedance、フレームや画像、参照動画を細かく制御したい場合はKlingを使います。

モデルが決まっていないときはAI動画生成器ハブが便利です。比較時は被写体、動き、比率、確認基準をそろえ、変わるのがモデルだけになるようにします。

よくあるVeo 3.1の問題

カメラが指示に従わない

カメラの動きを一つにし、方向と開始フレームを明確にします。映画用語の一覧ではなく「左から右へゆっくり横移動する」と書きます。動作が重要ならカメラの指定をさらに簡単にします。

音声と映像が合わない

音声の指示を、それを起こすイベントの近くに書き、音の設計を短くします。画像を確認してから生成音声を確認します。会話がある場合は台詞と話者を書き、雰囲気だけなら環境音を説明します。

参照した被写体が変わる

背景の情報量が少ない明瞭な画像を使い、重要な身元や商品の特徴をプロンプトで繰り返します。動く被写体を減らし、追加のカメラワークを足す前に短い動作を試します。

動画が公開先には大きすぎる

公開先に合った解像度を選び、不要な時間を切ります。最終MP4がまだ大きい場合は、映像を確認してから動画コンプレッサーでリサイズまたは圧縮します。

よくある質問

Google Veo 3.1 AI動画生成器はどう使いますか?

Veo AI動画生成器を開き、焦点を絞ったショットのプロンプトを書き、必要なら最大3枚の参照画像を追加し、Veo 3.1またはFastと出力設定を選んで生成します。

Veo 3.1とVeo 3.1 Fastの違いは何ですか?

Veo 3.1は品質を重視する主な選択肢で、Veo 3.1 Fastは素早い探索向けです。まずFastでコンセプトを確認し、概要が安定したら標準版で仕上げます。

Veo 3.1は音声を生成できますか?

はい。音声設定があり、会話、環境音、効果音、音楽をプロンプトで指定できます。公開前に音と映像を一緒に確認してください。

Veoでは何枚の参照画像を使えますか?

最大3枚の参照画像をアップロードできます。参照モードは8秒の動画になるため、長さより視覚的な固定を優先するときに使います。

Veo 3.1はどの解像度に対応していますか?

OpenVideoMakerでは720pから4Kまでの出力を選べます。目的の公開先で被写体と文字が読める最小の解像度を選び、必要な場合だけ大きな最終版を作ります。

Veoワークフローを続ける

Google Veo 3.1 AI動画生成器から始め、画像から動画へのプロンプトでカメラと動きのアイデアを確認します。物語や参照の流れが変わる場合はSora 2Seedanceを比較し、完成動画は動画トリマー動画リサイザー動画コンプレッサーで整えます。

関連記事