Google DeepMind 動画モデル · Google DeepMind
Veo 3.1 ガイド:映画的な映像とネイティブ音声
映画的品質、指示追従、ネイティブ音声、実際の設定から Veo 3.1 を評価します。
Genflow で試す最終確認: 2026年9月1日

先に結論
Veo 3.1 は Google DeepMind の動画生成モデルです。テキストと画像から動画を作り、台詞、環境音、効果音を映像と一緒に生成します。
選ぶべき場面
長い1本の動画より、映画的なリアルさ、指示追従、同期音声を重視する場合に適しています。
公式モデル情報
公式情報の要点
メーカーが公開した機能と Genflow の製品設定を分けて表示します。
テキストと画像から動画
Google は両方を Veo 3.1 の主要タスクとして紹介しています。
ネイティブ音声
台詞、環境音、効果音を映像と同時に生成します。
制作制御
参照画像、最初と最後のフレーム、カメラ、延長、物体挿入が紹介されています。
Genflow
Genflow の対応
現在の Genflow モデル設定から直接表示します。
- 生成方法
- キーフレームから動画, テキストから動画
- 時間
- 4, 6, 8 秒
- 比率
- 16:9, 9:16
- 出力
- 720p, 1080p
- ネイティブ音声
- 対応
適する場面
- リアルな物理と映画的なショットに向きます。
- 音声工程を減らせる可能性があります。
- Genflow では標準版と Fast 版を選べます。
確認が必要な点
- Genflow の時間は短く固定され、長い物語は複数クリップが必要です。
- 発音、同期、権利、ブランド安全の音声確認は必要です。
Veo 3.1
実用例
映画的な商品ショット
光、カメラ、動き、音を含む主役映像を作ります。
台詞付きコンセプト
本制作前に会話シーンを試作します。
画像から動画
承認済みのキービジュアルを構図を保って動かします。
FAQ
よくある質問
Veo 3.1 は音声を生成しますか?
はい。Google は台詞、効果音、環境音を映像と一緒に生成できると説明しています。
Genflow で使える時間は?
現在は4秒、6秒、8秒です。標準版と Fast 版があります。
画像から動画に向きますか?
はい。画像動画は主要機能で、Genflow でもキーフレームから動画を作れます。
公式情報
このページの情報は以下の公式資料で確認しています。