Stable Diffusionは、テキストの指示から高品質な画像を生成できるオープンソースの深層学習モデルです。潜在拡散モデルを採用しており、消費者向けの一般的なパソコンでも実行できる手軽さから、クリエイティブ分野や研究開発で広く活用されています。
Stable Diffusionとは
詳しく解説
Stable Diffusionは、ノイズから徐々に画像を復元していく拡散モデルの仕組みを、低次元の潜在空間で処理することで計算量を大幅に削減しています。ドイツのミュンヘン大学などの研究グループが開発し、2022年にコードとモデルウェイトが一般公開されました。誰でも無料で商用利用を含めて改変や再配布が可能なオープンソースとして提供された点が、AI界隈に大きな革命をもたらしました。
具体例・使われ方
例えば、「サイバーパンク風の街並みを歩く猫」といったプロンプトを入力することで、数秒から数十秒でオリジナルのイラストや写実的な写真を生成できます。また、既存の画像をベースにして一部を描き直すインペインティング機能や、アニメ風に特化させたモデルへの微調整など、多様な応用が可能となっています。
似た用語との違い
商用サービスとして提供されているMidjourneyやDALL-E 3と比較されることが多いですが、それらがクラウド上のAPI経由で利用するクローズドなシステムであるのに対し、Stable Diffusionは個人のPCにダウンロードして自由にカスタマイズできる点が大きく異なります。
注意点
学習データに著作権侵害の懸念がある画像が含まれていたという議論が存在します。また、悪意あるユーザーによるディープフェイクや肖像権を侵害する画像作成への悪用リスクが指摘されており、倫理的な運用ガイドラインの策定が重要な課題となっています。
この解説は役に立ちましたか?誤りが含まれる場合はご報告いただけますと幸いです。
更新日時: 2026年8月29日 13:21