動画生成AIとは
Text-to-Video / テキスト動画生成
テキストや画像などの指示から動画を生成するAI技術の総称
ひとことで言うと
概要
動画生成AIとは、テキストや画像などの指示から動画を生成するAI技術の総称を指す。 拡散モデルを時間方向へ拡張し、フレーム間の一貫性を保ちながら映像を生成する方式が主流で、SoraやVeoなどのモデルが代表例になる。 数秒から数十秒の短い映像の生成が中心だが品質の向上は速く、広告・映像制作・プロトタイピングでの活用が広がっている。一方で、ディープフェイクへの悪用や学習データの権利面の課題も議論されている。
歴史
2022年頃からMetaのMake-A-VideoやGoogleのImagen Videoなどの研究発表が相次ぎ、2024年2月のSoraの発表を機に注目が高まった。