【テキストトゥイメージ】

Text-to-Image(画像生成AI) とは?

最終更新:
💡 言葉で伝えたイメージを、画像にするAI

文章で伝えた内容を手がかりに、AIで画像を生成する技術。構図や被写体、画風などを指定できるが、結果が指示どおりになるとは限らず、確認や調整が必要になる。

📌 このページのポイント
Text-to-Image:言葉から画像へ夕焼けの海辺にいる猫画像生成AI指示を手がかりに生成した画像構図・画風・文字を見て調整指示どおりか、仕上がりを確認しよう
文章から画像を生成するイメージです。猫の絵は説明用の図で、モデルの実際の出力ではありません。
ひよこ ひよこ
Text-to-Imageって、どんなことができるの?
ペンギン先生 ペンギン先生
文章で伝えたイメージから画像を作れるよ。たとえば「夕焼けの海辺にいる猫、水彩画風」のように、被写体や場所、画風を指定するんだ。指示を手がかりに生成するので、思いどおりの構図になったかは、出来上がった画像で確認しよう。
ひよこ ひよこ
文章から、どうやって絵ができるの?
ペンギン先生 ペンギン先生
学習したモデルが文章を手がかりに画像を生成するんだ。拡散モデルでは、ノイズから少しずつ画像を整えるような処理を使うよ。潜在拡散モデルは、その処理を画像の特徴を圧縮した表現の中で行うんだ。ただし、すべての画像生成AIが同じ内部方式とは限らないね。
ひよこ ひよこ
看板の文字や細かな指定も、必ず正確に描ける?
ペンギン先生 ペンギン先生
結果を確かめよう。たとえばMidjourneyの公式資料も、画像内の文字では短い語句などが扱いやすく、うまくいかない場合は設定や編集で調整する方法を案内しているよ。生成後に、文字や形、必要な内容が合っているかを見て、指示を直したり編集したりするんだ。
ひよこ ひよこ
生成した画像は、どんな用途でも自由に使える?
ペンギン先生 ペンギン先生
使うモデルやサービスの規約、利用目的に合う条件を確認しよう。たとえばStability AIが公開するモデルにも、利用者や用途に応じたライセンス条件があるよ。「モデルが公開されている」ことと、「どんな使い方も無条件で許される」ことは同じではないんだ。公開前には、画像の内容や他者の権利も確認しよう。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「Text-to-Image」って出てきたら「文章で伝えたイメージから、画像を作ってくれるAI」と思えばだいたいOK!
📖 おまけ:英語の意味
「Text-to-Image」 = 文章から画像へ
💬 Textは文章、Imageは画像という意味だよ。生成したい被写体や雰囲気を、プロンプトと呼ばれる指示で伝えるんだ

参考資料

← 用語集にもどる