【ステーブルディフュージョン】
Stable Diffusion とは?
最終更新:
💡 言葉を手がかりに、ノイズから画像を作るAI
文章などを手がかりに画像を生成する、拡散モデルの系列。画像の圧縮表現を扱う潜在拡散の技術を使い、公開された重みを自分の環境で動かせるモデルもある。利用条件、必要な計算資源、機能はモデルの版と実行方法による。
📌 このページのポイント
- テキストを条件として、ノイズから画像を生成する
- 潜在表現で生成処理を行い、画像へ戻す仕組みを使う
- 公開された重みを、対応する環境で実行できる
- 追加学習や商用利用は、モデルごとのライセンスを確認する
どうやって文章から絵を描くの?
文章を数値の表現へ変え、それを手がかりにノイズから生成するよ。潜在拡散では、画像を圧縮した表現に相当する空間で処理し、最後に画像へ戻す。学習した関係を使う仕組みで、人と同じ理解をしているという意味ではないんだ
Stable Diffusionは、一つのモデルなの?
複数の版や構成がある系列だよ。初期の公開モデルはCompVis、Stability AI、Runwayなどの協力で作られた。モデルの版が違うと機能や必要なメモリも変わる。記事や設定を見るときは、どのモデルの説明か確認しよう
誰でも、無料で自由に使える?
公開された重みを使えることと、無条件の利用許可は別だよ。モデルごとにライセンスがあり、用途や収益などによって条件が変わる場合がある。自分で動かすにも機器や電力が必要で、外部サービスの料金も別なんだ
LoRAで、好きな画風にできる?
追加する少数の重みを学習して、モデルを調整する方法だよ。全体を学習し直すより、学習するパラメーターを減らせる。ただし、学習データや設定で結果は変わり、数十枚あれば必ず再現できるという保証ではない。元モデルと追加データの利用条件も確認しよう
PCのスペックや、生成画像の使い方は?
まとめ:ざっくりこれだけ覚えればOK!
「Stable Diffusion」って出てきたら「言葉などを手がかりに画像を作る拡散モデルの系列」と思えばだいたいOK!
📖 おまけ:英語の意味
「Stable Diffusion」 = Stable Diffusionというモデル名
💬 stableは安定した、diffusionは拡散という意味だよ。名称だけで、出力が必ず安定する、高品質になるという保証ではないんだ