Re Reference AI

技術

動画生成AIとは

Text-to-Video / テキスト動画生成

テキストや画像などの指示から動画を生成するAI技術の総称

動画生成生成AI

ひとことで言うと

文章や1枚の画像から動く映像を作り出すAI技術のまとめ言葉。SoraVeoが代表例。

概要

動画生成AIとは、テキストや画像などの指示から動画を生成するAI技術の総称を指す。 拡散モデルを時間方向へ拡張し、フレーム間の一貫性を保ちながら映像を生成する方式が主流で、SoraVeoなどのモデルが代表例になる。 数秒から数十秒の短い映像の生成が中心だが品質の向上は速く、広告・映像制作・プロトタイピングでの活用が広がっている。一方で、ディープフェイクへの悪用や学習データの権利面の課題も議論されている。

歴史

2022年頃からMetaのMake-A-VideoやGoogleのImagen Videoなどの研究発表が相次ぎ、2024年2月のSoraの発表を機に注目が高まった。

関連用語

SoraVeo拡散モデルディープフェイクStable Diffusion

関連Zenn記事