【テキストトゥイメージ】
Text-to-Image(画像生成AI) とは?
最終更新:
💡 言葉で伝えたイメージを、画像にするAI
文章で伝えた内容を手がかりに、AIで画像を生成する技術。構図や被写体、画風などを指定できるが、結果が指示どおりになるとは限らず、確認や調整が必要になる。
📌 このページのポイント
- 文章の指示を手がかりに、画像を生成する
- 拡散モデルなどが使われるが、内部の方式はモデルによって違う
- 構図・画風・文字などの仕上がりを確認し、必要に応じて調整する
- 公開や商用利用では、利用するモデルやサービスの条件も確認する
Text-to-Imageって、どんなことができるの?
文章で伝えたイメージから画像を作れるよ。たとえば「夕焼けの海辺にいる猫、水彩画風」のように、被写体や場所、画風を指定するんだ。指示を手がかりに生成するので、思いどおりの構図になったかは、出来上がった画像で確認しよう。
文章から、どうやって絵ができるの?
看板の文字や細かな指定も、必ず正確に描ける?
結果を確かめよう。たとえばMidjourneyの公式資料も、画像内の文字では短い語句などが扱いやすく、うまくいかない場合は設定や編集で調整する方法を案内しているよ。生成後に、文字や形、必要な内容が合っているかを見て、指示を直したり編集したりするんだ。
生成した画像は、どんな用途でも自由に使える?
使うモデルやサービスの規約、利用目的に合う条件を確認しよう。たとえばStability AIが公開するモデルにも、利用者や用途に応じたライセンス条件があるよ。「モデルが公開されている」ことと、「どんな使い方も無条件で許される」ことは同じではないんだ。公開前には、画像の内容や他者の権利も確認しよう。
まとめ:ざっくりこれだけ覚えればOK!
「Text-to-Image」って出てきたら「文章で伝えたイメージから、画像を作ってくれるAI」と思えばだいたいOK!
📖 おまけ:英語の意味
「Text-to-Image」 = 文章から画像へ
💬 Textは文章、Imageは画像という意味だよ。生成したい被写体や雰囲気を、プロンプトと呼ばれる指示で伝えるんだ