Stable Diffusionって、結局なに?
なんとなく知っているけど、意外と「Stable Diffusion」って結局なんなんだ?と言われると、答えに詰まる方も多いと思います。 簡単に言うと、Stable Diffusion は
ひとことで言えば、文章から画像を作るAIで、モデル本体が無料で配られているものです。
サービスそのものではなく、あくまでも画像を生成するモデルのことを Stable Diffusion と呼んでいます。
ただ、この「無料」がいろいろな誤解を生んでおり、管理人も実際に触るまで勘違いしていました。
実際に課金して測った数字も一緒に置いておきます。
インストールせずに試す手順はStable Diffusionをインストールせずに使う方法にまとめています。
そもそもStable Diffusionとは
文章を入れると画像を作ってくれるAIです。2022年に公開され、AI画像生成が一般に広まるきっかけになったモデルのひとつです。
他のサービスとの一番の違いは、AIの本体(モデル)そのものが配布されていることです。
| Stable Diffusion | Midjourney・GPT Imageなど | |
|---|---|---|
| 使い方 | 自分のPCにモデルを入れて動かせます | 相手のサーバーで動かします |
| 費用 | モデルは無料(動かす機材は自前) | 月額または従量課金 |
| カスタマイズ | 絵柄の追加学習や細かい設定ができます | 用意された範囲で使います |
| 作ったものの公開 | ローカルなら外に出ません | サービスの設定によります |
この「自分の手元で動かせる」ことが、Stable Diffusionが支持されている理由です。絵柄を追加学習させたり、生成の細かいパラメータを詰めたりできます。
逆に言えば、そこに魅力を感じないなら、わざわざStable Diffusionを選ぶ理由は薄いということでもあります。
今回の記事では、Stable Diffusion をただ説明するだけだと、Wikipedia とか生成 AI に聞いてくれればいいという話になるので、具体的によくある誤解について説明していきます。
よくある誤解1:無料だけど、動かす場所は自前
一番多い勘違いとして、あくまでもStable Diffusionにおいて無料なのはモデル本体であって、動かす環境ではない ということです。
若干わかりにくいので、以下の表にもまとめておきます。
| 何が | 無料か |
|---|---|
| モデル(AIの本体) | 無料 |
| GPUを積んだPC | 自分で用意します |
| ブラウザで使うサービス | お試し枠のみ |
PCさえあれば何枚作ってもゼロ円なのは事実でありますが、一方で、Stable Diffusionモデルを動かすことのできるPCが無ければどこかに払うことになります。
管理人はGPUを積んだPCを持っていないので、ブラウザから使えるサービス経由で検証しています。そちらでの実測は1枚10クレジット(約33円)でした。
損益分岐で考えると、1枚33円ですから3,000枚ほどでPC1台ぶんに届きます。そこまで作らないなら、機材を買わずに済ませたほうが安上がりです。

誤解2:プロンプトは英語で
Stable Diffusion は日本語でのプロンプト入力に対応しておらず、英語でプロンプトを入力する必要があります。
今回は実際にStable Diffusion 3に、日本語と英語で同じ内容のプロンプトを入れて各4枚ずつ生成しました。使った文章は「夜の路地裏にある小さなラーメン屋台。湯気とネオンの反射。年配の店主が鍋を振っている。シネマティックな照明。」です。
| 指示した要素 | 日本語 | 英語 |
|---|---|---|
| 夜/路地裏/屋台 | × | ○ |
| ラーメン | ○ | ○ |
| 湯気/ネオン/店主が鍋を振る | × | ○ |
7つの要素のうち、日本語で通ったのは「ラーメン」だけでした。英語では7つとも出ています。払ったクレジットはどちらも同じ40です。
「プロンプトが難しすぎたのでは」とも考えて、同じ日本語プロンプトを他の4モデル(Midjourney V8.1・GPT Image 2・Ideogram v2 Turbo・Recraft v3)にも入れましたが、4つとも問題なく描けました。落ちたのはStable Diffusion 3だけです。
難しい英語である必要はありません。翻訳ツールに通した直訳で十分でした。

誤解3:インストールしなくても使える
「Stable Diffusionを使う=PCに環境を作る」と思われがちですが、ブラウザから使えるサービスもあります。GPUもPythonもモデルファイルのダウンロードも要りません。
ただし正直に書いておくと、ローカルでできることの多くは、ブラウザ経由ではできません。
| できること | ローカル | ブラウザ経由 |
|---|---|---|
| モデル(checkpoint)の差し替え | できます | できません |
| LoRA(絵柄の追加学習) | できます | できません |
| ネガティブプロンプト | できます | 欄がありません |
| ステップ数・シードの指定 | できます | できません |
| 準備の手間 | 環境構築が必要 | 不要 |
ブラウザ経由は「Stable Diffusionを使う」というより「Stable Diffusion 3という1つのモデルを試す」に近いです。まずどんな絵が出るか見てみたい、という段階なら高いパソコンを買わずに、数百円で済みます。
誤解4:バージョンによってライセンスが違う
「オープンソースだから何でも自由」ではありません。Stability AI公式のライセンスは2種類です(2026年7月31日確認)。
| ライセンス | 対象 | 費用 |
|---|---|---|
| Community | 年間収益100万ドル未満の個人・組織 | 無料(商用利用も含みます) |
| Enterprise | 年間収益100万ドル超の企業・APIプロバイダ | 個別見積もり |
Communityに含まれるモデルとして公式が挙げているのはStable Diffusion 3.5 Suite・SDXL Turbo・Stable Audio 3.0・Stable Fast 3Dです。
ここで注意です。公式が名前を挙げているのはバージョンごとで、古いもの(SD 1.5など)は別のライセンスで配布されていた経緯があります。「Stable Diffusionだから全部同じ」ではありません。お使いのバージョンごとに確認してください。
ちなみに、似たようなオープンウェイトのモデルでも条件は正反対のことがあります。Fluxを開発しているBlack Forest Labsの場合、自分で動かして商用に使うには有償ライセンスが必要で、公開されている重みは非商用が前提でした。
他のモデルとの比較
同じ日に同じ日本語プロンプトで5モデルを生成して比べました。すべて4枚出力・16:9の統制条件です。
| モデル | 4枚あたり | 解像度 | 日本語プロンプト |
|---|---|---|---|
| Midjourney V8.1 | 12クレジット | 1456×816 | 通ります |
| GPT Image 2 | 16(無制限で0) | 2560×1440 | 通ります |
| Stable Diffusion 3 | 40クレジット | 1344×768 | 通りません |
| Recraft v3 | 48クレジット | 1820×1024 | 通ります |
| Ideogram v2 Turbo | 60クレジット | 1312×736 | 通ります |
ブラウザ経由で使うかぎり、Stable Diffusion 3は割高な部類です。Midjourney V8.1の3倍以上の値段で、解像度はいちばん低く、日本語も利用できません。
それでもStable Diffusionが選ばれる理由は、ローカルで動かしたときの自由度にあります。ブラウザ経由ではその持ち味が使えないので、こういう並びになります。
「まず試す」ならブラウザ経由、「本気でやる」ならローカル。途中の使い方がいちばん噛み合いません。

よくある質問(FAQ)
最後に Stable Diffusion について、以下にまとめておきます。
Stable Diffusionとは何ですか?
文章から画像を作るAIで、2022年に公開されました。他のサービスと違うのは、AIの本体(モデル)そのものが配布されていて、自分のPCで動かせることです。絵柄の追加学習や細かい設定ができる自由度が支持されています。
本当に無料で使えますか?
モデル本体は無料です。年間収益100万ドル未満なら商用利用まで無料と公式ライセンスに明記されています。ただし動かすためのGPUは自分で用意する必要があり、そこが実質的な費用になります。機材が無い場合はブラウザから使えるサービス経由で1枚10クレジット(約33円)でした。
プロンプトは日本語で書けますか?
通りませんでした。管理人がStable Diffusion 3で試したところ、日本語で指示した7要素のうち反映されたのは「ラーメン」の1つだけです。英語に直したら7つとも出ました。翻訳ツールに通した直訳で十分ですので、英語で書いてください。
インストールしないと使えませんか?
ブラウザから使えるサービスもあります。GPUもPythonも要りません。ただしモデルの差し替え、LoRA、ネガティブプロンプト、ステップ数やシードの指定はいずれもできませんでした。作り込みたい場合はローカル環境が必要です。
初心者はStable Diffusionから始めるべきですか?
作り込みに興味がないなら、必ずしもそうではありません。同じ日に比べたところ、ブラウザ経由ではStable Diffusion 3が4枚40クレジットに対し、Midjourney V8.1が12クレジット、GPT Image 2が16クレジット(無制限なら0)でした。しかも後者2つは日本語プロンプトが通ります。まず画像生成を体験したいだけなら、そちらのほうが安く簡単です。
まとめ
Stable Diffusionとは、文章から画像を作るAIで、モデル本体が無料で配布されているものです。自分のPCで動かせて、絵柄の追加学習や細かい設定ができる自由度が最大の魅力です。
ただし実際に触ってみると、思い込みと違うところが4つありました。無料なのはモデルであって動かす機材は自前だということ。プロンプトは英語で書く必要があること(日本語では7要素中1つしか通りませんでした)。インストールしなくてもブラウザから使えるが、そのぶんLoRAもネガティブプロンプトも使えないこと。そしてバージョンによってライセンスが違うことです。
ブラウザ経由で使うかぎり、Stable Diffusion 3は4枚40クレジットで、Midjourney V8.1の12クレジットより割高です。解像度も低く、日本語も通りません。それでもStable Diffusionが選ばれるのは、ローカルで動かしたときの自由度があるからです。まず画像生成を体験したいだけなら他のモデルのほうが安く簡単で、本気で作り込みたいならローカル環境を用意する。この2択で考えるとすっきりします。
30以上のモデルを1つのアカウントで
Kling・Veo・Soraを個別に契約しなくても、Pollo AIならまとめて試せます。管理人もプロプラン(月額$29)で検証しています。
※広告リンクです。ここから登録いただくと管理人のお財布が少しあたたまり、次の検証の課金代になります。もちろんみなさんの料金は変わりません。


コメント