モデル

Google DeepMind 動画モデル · Google DeepMind

Veo 3.1 ガイド:映画的な映像とネイティブ音声

映画的品質、指示追従、ネイティブ音声、実際の設定から Veo 3.1 を評価します。

Genflow で試す最終確認: 2026年9月1日
Veo 3.1 workflow context
Genflow のワークフロー例です。モデルのベンチマーク結果ではありません。

先に結論

Veo 3.1 は Google DeepMind の動画生成モデルです。テキストと画像から動画を作り、台詞、環境音、効果音を映像と一緒に生成します。

選ぶべき場面

長い1本の動画より、映画的なリアルさ、指示追従、同期音声を重視する場合に適しています。

公式モデル情報

公式情報の要点

メーカーが公開した機能と Genflow の製品設定を分けて表示します。

テキストと画像から動画

Google は両方を Veo 3.1 の主要タスクとして紹介しています。

ネイティブ音声

台詞、環境音、効果音を映像と同時に生成します。

制作制御

参照画像、最初と最後のフレーム、カメラ、延長、物体挿入が紹介されています。

Genflow

Genflow の対応

現在の Genflow モデル設定から直接表示します。

生成方法
キーフレームから動画, テキストから動画
時間
4, 6, 8 秒
比率
16:9, 9:16
出力
720p, 1080p
ネイティブ音声
対応

適する場面

  • リアルな物理と映画的なショットに向きます。
  • 音声工程を減らせる可能性があります。
  • Genflow では標準版と Fast 版を選べます。

確認が必要な点

  • Genflow の時間は短く固定され、長い物語は複数クリップが必要です。
  • 発音、同期、権利、ブランド安全の音声確認は必要です。

Veo 3.1

実用例

映画的な商品ショット

光、カメラ、動き、音を含む主役映像を作ります。

台詞付きコンセプト

本制作前に会話シーンを試作します。

画像から動画

承認済みのキービジュアルを構図を保って動かします。

FAQ

よくある質問

Veo 3.1 は音声を生成しますか?

はい。Google は台詞、効果音、環境音を映像と一緒に生成できると説明しています。

Genflow で使える時間は?

現在は4秒、6秒、8秒です。標準版と Fast 版があります。

画像から動画に向きますか?

はい。画像動画は主要機能で、Genflow でもキーフレームから動画を作れます。

公式情報

このページの情報は以下の公式資料で確認しています。