【どうがせいせいえーあい】
動画生成AI とは?
最終更新:
💡 言葉や画像から、動く場面を作る
文章や画像などの入力に沿って動画を生成するAI。描きたい場面や動きを指示したり、画像を出発点にしたりできる。入力・長さ・音声への対応はモデルによって異なり、生成結果を確認して使う。
📌 このページのポイント
- 文章から動画、画像から動画などの方式がある
- 場面だけでなく、被写体やカメラの動きを指示できる
- 長さ・解像度・音声・待ち時間はモデルごとに異なる
- 生成結果を確認し、撮影した事実の記録と区別する
文章から動画を作れるの?
対応するモデルならできるよ。たとえば「海辺を走る犬。カメラは横から追う」のように、場面と動きを伝える。写真などの画像を出発点にして動きを作る方式もある。入力できるものは、使うモデルや機能によるんだ。
画像から動画を作るときも、文章は使う?
使う方式があるよ。Runway Gen-4.5のImage to Videoは、画像と文章を入力し、文章では主に場面の動きを伝える。Text to Videoでは、見せたいものと動きの両方を文章で説明する。同じサービスでも、選んだ機能で入力が違うんだ。
ボタンを押したら、すぐ長い動画ができる?
音も付くの?できた映像は、そのまま使える?
生成した動画と分かる仕組みはある?
GoogleはVeoの動画へSynthIDの透かしを付け、生成コンテンツの識別を助けると説明しているよ。ただ、全サービスが同じ仕組みとは限らない。公開するときは、使うサービスの利用条件や入力素材の扱いを確認し、生成した映像だと分かる形で共有しよう。
📖 おまけ:英語の意味
「Video Generation AI」 = 動画を生成するAI
💬 映像の内容を作る生成AIの一種。ここでは、撮影済みの動画を切り貼りする編集だけとは区別して説明するよ。