Re Reference AI

モデル

Veoとは

Google Veo

Google DeepMindが開発する、テキストや画像から音声付きの動画を生成するAIモデル

動画生成Google

ひとことで言うと

Googleの動画生成AI。文章や画像から映像を作れて、新しい版ではセリフや効果音まで一緒に生成できる。

概要

Veoとは、Google DeepMindが開発するテキストや画像から動画を生成するAIモデルを指す。 2025年に公開されたVeo 3では映像と同期した音声・効果音・会話の生成に対応し、音付きの動画を一度に生成できる点が特徴になった。 Geminiアプリや動画作成ツールFlowなどを通じて提供され、Soraと並ぶ動画生成AIの代表例として扱われている。

歴史

2024年5月の開発者会議Google I/OでGoogle DeepMindが発表した。2024年12月にVeo 2、2025年5月に音声生成へ対応したVeo 3を公開した。

比較

  • Soraいずれもテキストから動画を生成するモデルで、Veo 3は映像と同期した音声の生成へ対応した点を特徴として打ち出した

関連用語

動画生成AISoraGemini拡散モデル

関連Zenn記事