本文へ移動
Stable Diffusionの始め方・使い方|初心者が最初の1枚を作る手順
Stable Diffusion入門

Stable Diffusionの始め方・使い方
初心者が最初の1枚を作る手順


このページのプロンプトを検索

Stable Diffusion(SD)は、文章や画像をもとに画像を生成するAIモデルの一群です。使い始めるには、モデルを動かすサービスやアプリを選び、描きたい内容を入力します。このページでは、環境選びから最初の1枚の生成、結果の調整までを順に説明します。すでに生成できる方は、入力例や基本プロンプト96項目の一覧へ進めます。

広告

Stable Diffusionとは?モデルとアプリの違い

Stable Diffusionは画像を作る「モデル」、ComfyUIなどはそのモデルを操作する「アプリ」です。同じアプリでも、読み込むモデルを変えると得意な画風や必要な設定が変わります。Webサービスでは、モデルの準備や計算をサービス側が行います。

文章から画像を作る方法をtext-to-image、画像を手がかりに作り直す方法をimage-to-imageと呼びます。初めてなら、元画像を用意しなくてよいtext-to-imageから始めると流れをつかめます。

始め方を選ぶ|ブラウザーで試す・PCで動かす

準備を少なくして試したい

ブラウザーの画像生成サービスが候補です。自分のPCにモデルを入れずに使えます。利用できるモデル、生成回数、料金、画像の扱いはサービスによって異なります。

ブラウザーで作る手順へ

モデルや設定を自分で選びたい

PCにComfyUIなどを導入する方法が候補です。アプリとモデルの準備が必要です。生成速度や扱える画像サイズはGPU・VRAMなどの構成に左右されます。

PCで作る手順へ

迷ったら、まずブラウザーで「入力して画像が出る」体験をしてから、使いたいモデルが見つかった段階でPC環境を検討すると進めやすくなります。無料枠や料金は変わるため、利用開始前に各サービスの案内を確認してください。

最初の1枚を作る手順

どちらの方法でも、最初は1つの主題を短く指定し、1枚ずつ生成します。ここでは「窓辺のテーブルに置かれた白いカップ」を練習用の題材にします。

方法A:ブラウザーで生成する

公式サービスの例として、Stability AIのStable Assistantがあります。以下は公式の使い方に沿った流れです。

  1. サービスを開き、画面の案内に沿ってアカウントと利用プランを確認します。
  2. 新しいチャットを開きます。画像の縦横比を選べる場合は、最初は正方形にします。
  3. メッセージ欄に下の例を貼り付け、送信します。「画像を生成する」という指示も含めています。
  4. 出てきた画像を確認します。変えたい点があれば、カップの色や光など、変更を1つに絞って伝えます。
  5. 気に入った画像を保存し、使った入力文も一緒に残します。
Generate an image of a white ceramic cup on a wooden table beside a window, soft morning light.

サービス側がモデルや設定を管理するため、ローカルのStable Diffusionと同じ操作・結果になるとは限りません。操作の参照先:Stable Assistant公式ガイド。

方法B:PCのComfyUIで生成する

こちらはComfyUI公式のSD1.5用text-to-imageワークフローを使うルートです。ワークフローは、モデル・入力文・生成・保存の処理をつないだ設定一式を指します。最初から自作せず、公式の例を読み込みます。

  1. Windows向けの公式導入案内に沿ってComfyUIを準備し、起動します。OSが違う場合は、公式サイトで対応する導入案内を選びます。モデルの保存容量も確保してください。
  2. 公式のtext-to-imageチュートリアルを開き、案内されているSD1.5モデルを用意します。モデルファイルは、使用するComfyUIのmodels/checkpointsに配置します。
  3. 同チュートリアルのワークフロー入り画像をダウンロードし、ComfyUIにドラッグして読み込みます。これは設定が埋め込まれた画像です。通常のスクリーンショットでは読み込めません。
  4. Load Checkpointで用意したモデルを選びます。positiveにつながるテキスト入力に、下の短い例を入れます。negative側は最初は空欄でも構いません。
  5. まず公式ワークフローの設定で、生成枚数を1枚にして実行します。公式ガイドではQueueまたはCtrl + Enterで生成できます。
  6. Save Imageに結果が出たら画像を保存します。入力文、モデル名、設定も残すと、あとで変更前と比較できます。
white ceramic cup, wooden table, window, soft morning light

この手順はSD1.5用です。SDXL・SD3系や追加学習モデルを使う場合は、そのモデルに対応したワークフローと推奨設定を選びます。別系統のモデルをファイル名だけ差し替えて使うことは避けてください。

プロンプトの書き方|主題から1つずつ足す

プロンプトは「描いてほしい内容」を伝える入力です。最初に主題を決め、場所・光・画風などを必要な分だけ追加します。下は入力を考える例で、生成結果の比較画像ではありません。

  1. 主題:white ceramic cup(白い陶器のカップ)
  2. 置く場所:white ceramic cup, wooden table(木のテーブルを追加)
  3. 光:white ceramic cup, wooden table, soft morning light(朝の柔らかい光を追加)

カップを青くしたいならwhiteをblueに替えます。昼と夜、立つと座るなど、両立しにくい指定は同時に増やさず、どちらを描きたいか選びましょう。文章で説明するか短い英語を並べるかは、使うモデルやサービスの推奨に合わせます。

ネガティブプロンプトは、避けたい要素を別欄へ

対応する環境では、不要な要素をnegative欄に入れます。例えば文字を避けたいときのtextです。描いてほしいものを入れるpositive欄と取り違えないようにしてください。最初から長い定型文を入れず、出てきた問題に応じて試します。指定だけで確実に除去できるわけではありません。

個別の対処はネガティブ・失敗対策プロンプト一覧で探せます。

最初に知っておきたい設定

すべてを調整する必要はありません。最初はモデルとワークフローの推奨値を使い、結果を見て1項目ずつ変えるのが出発点です。ブラウザーサービスでは、以下の設定が表示されないこともあります。

モデル / Checkpoint

生成に使う学習済みデータです。アニメ・写真などの得意分野と、対応するモデル系統を確認します。

画像サイズ

幅と高さです。最初から大きくせず、モデルの推奨サイズを使います。生成できないときはサイズと同時生成枚数を確認します。

Seed

生成のランダム性に関わる値です。入力文の効果を比べるときは、モデルや設定とともに固定します。Seedだけ同じでも、環境が違えば同じ画像になるとは限りません。

Steps / CFG

Stepsは生成処理の反復回数、CFGは入力条件への誘導の強さに関わります。大きくするほど良くなる設定ではなく、推奨値はモデルによって違います。

Sampler / Scheduler

生成処理の進め方に関わる設定です。初回はワークフローの指定を使い、ほかの条件と同時に変更しないようにします。

LoRA

特定の表現などを追加するための仕組みです。最初の生成には必須ではありません。使うときは元モデルとの対応を確認します。

設定とモデル差の参考:Diffusers公式のtext-to-imageガイド。

人物・背景を描く短い入力例

下の例から目的に近いものを1つ選び、必要な部分だけ差し替えて試してください。複数の例を全部つなげる必要はありません。

人物を1人描く

1woman, solo, standing, simple background

人物と姿勢を決める最小限の出発点。まず何が出るか見てから語句を足します。

背景だけを描く

forest path, sunlight through trees, no humans

森の小道を主題にする例。人物を描く語句とは別に試します。

人物に場所と画風を足す

1woman, solo, standing in a garden, soft daylight, anime style

人物・場所・光・画風の組み合わせ。気になる部分を1つずつ差し替えます。

入力の組み立て例です。特定モデルでの生成結果を保証するサンプルではありません。使用するモデルや設定に合わせて調整してください。

うまくいかないときの確認順

画像が出ない・エラーになる

まずエラー文を確認します。モデルが選べているか、必要なファイルがそろっているか、ワークフローとモデルが対応しているかを見ます。メモリ不足と表示された場合は、同時生成を1枚にし、推奨範囲で画像サイズを下げて試します。ブラウザーでは利用上限やサービスの状態も確認します。

描いてほしいものが反映されない

長い入力をいったん主題だけに戻します。矛盾した指定やnegative欄への入れ間違いがないかを確認し、主題が出たら必要な条件を1つずつ戻します。選んだモデルが描きたい画風に合うかも確認してください。

手・顔・複雑な形が崩れる

人物の人数、動作、持ち物を減らして確認します。難しい箇所は、別の生成結果を選ぶ方法や、対応環境で部分修正する方法もあります。bad handsなどの語句だけで必ず直るわけではありません。

サンプルと同じ画像にならない

モデル、追加モデル、Seed、サイズ、生成設定が違えば結果も変わります。このページの入力例は練習用で、特定モデルでの再現を検証したレシピではありません。まず「主題が出たか」「変えた条件が反映されたか」を確認しましょう。

基本プロンプト96項目|必要な語句を探す

下の一覧は、生成できるようになってから表現を足すための辞典です。全部をまとめてコピーする必要はありません。「失敗対策」の語は、対応するネガティブ欄に入れる候補です。品質・人物の補助語も、効果はモデルによって異なります。

品質の基本

日本語プロンプト用途コピー
最高品質masterpiece
高品質best quality
細部まで描写highly detailed
鮮明sharp focus
きれいな描写clean details
完成度の高い絵polished illustration
自然な質感natural texture

人物の基本

日本語プロンプト用途コピー
1人solo
上半身upper body
全身full body
こちらを見るlooking at viewer
自然な笑顔gentle smile
立ち姿standing pose
座り姿sitting pose

構図の基本

日本語プロンプト用途コピー
正面構図front view
横向きside view
三分割構図rule of thirds
中央配置center composition
バストアップportrait shot
広角wide angle
クローズアップclose-up

広告

光の基本

日本語プロンプト用途コピー
自然光natural lighting
柔らかい光soft lighting
逆光backlighting
夕方の光golden hour light
室内光indoor lighting
映画風の光cinematic lighting
リムライトrim light

背景の基本

日本語プロンプト用途コピー
白背景simple white background
部屋cozy room
カフェcozy cafe
街並みcity street
森forest path
海辺seaside
教室classroom

画風の基本

日本語プロンプト用途コピー
アニメ風anime style
実写風photorealistic
水彩風watercolor style
厚塗りpainterly style
線画line art
3D風3d render
映画風cinematic style

広告

失敗対策

日本語プロンプト用途コピー
低品質を避けるlow quality
ぼやけを避けるblurry
崩れた手を避けるbad hands
余分な指を避けるextra fingers
文字を避けるtext
透かしを避けるwatermark
歪みを避けるdistorted

組み合わせの軸

日本語プロンプト用途コピー
人物基本セットsolo, looking at viewer, upper body
日常セットcasual outfit, cozy room, natural lighting
ポートレートセットportrait shot, soft lighting, sharp focus
風景セットwide shot, detailed background, atmospheric lighting
アニメ立ち絵anime style, full body, simple background
写真ポートレートphotorealistic, portrait shot, natural skin
映画風カットcinematic composition, dramatic lighting, depth of field

人物を安定させる語句

日本語プロンプト用途コピー
自然な手natural hands
整った顔well-proportioned face
自然な肌natural skin
きれいな目clear eyes
自然な姿勢natural pose
バランスの良い体balanced body
穏やかな表情calm expression
清潔感のある服装clean outfit
自然な髪natural hair
柔らかい表情soft expression

広告

背景を足す基本

日本語プロンプト用途コピー
公園park
駅前station square
図書館library
寝室bedroom
リビングliving room
屋上rooftop
雨の街rainy street
夕焼け空sunset sky
花畑flower field
雪道snowy road

失敗しにくい組み立て

日本語プロンプト用途コピー
人物と白背景solo, simple white background
人物と自然光solo, natural lighting
人物とカフェsolo, cozy cafe
上半身ポートレートupper body, portrait shot
全身立ち絵full body, standing pose
アニメ調の人物anime style, solo
実写風ポートレートphotorealistic portrait
柔らかい光の部屋soft lighting, cozy room
街角スナップcity street, candid shot
背景をぼかすdepth of field, blurred background

調整用キーワード

日本語プロンプト用途コピー
もっと明るくbrighter lighting
もっと暗くdarker mood
背景をシンプルにsimple background
細部を増やすmore detailed
柔らかくするsofter look
鮮明にするsharper details
色を淡くするsofter colors
色を鮮やかにするmore vivid colors
落ち着いた雰囲気calmer mood
映画風にするmore cinematic

選び方と調整のポイント

  1. 気に入った画像と、入力文・モデル名・設定を保存します。
  2. 比較するときは同じ環境で1つの条件だけを変え、結果を見てから次へ進みます。
  3. 必要な単語が増えたら、下の専門辞典で服装・背景・画風ごとに探します。

よくある質問

Stable Diffusionは無料で始められますか?

使うアプリ、モデル、サービスによって異なります。Webサービスの無料枠や料金は提供元で確認してください。PCで動かす場合も、機材や電気代、モデルごとの利用条件を考える必要があります。

スマホやGPUのないPCでも使えますか?

ブラウザーで提供されるサービスなら、自分の端末に生成用GPUを用意せずに使える場合があります。ローカル生成の対応機種や必要な性能は、アプリとモデルの公式要件を確認してください。

プロンプトは日本語でも書けますか?

対応はモデルやサービスによって異なります。このサイトの辞典は英語入力を想定しています。日本語で意図が伝わりにくい場合は、必要な英語を短く組み合わせて試してください。

最初からLoRAや長いネガティブプロンプトが必要ですか?

必須ではありません。まず基本モデルと短い入力で1枚作り、追加したい表現や困った点が明確になってから、対応する機能や語句を足します。

同じプロンプトなら同じ画像になりますか?

同じ入力文だけでは一致しません。モデル、Seed、サイズ、生成設定なども結果に関わります。このページの例は入力の練習用で、同じ画像を再現するための検証済みレシピではありません。

最初の1枚ができたら、次は何を変えればよいですか?

気に入った結果と設定を保存し、服装・背景・画風などから変更したいものを1つ選びます。比較できる環境ではSeedやほかの設定をそろえると、入力を変えた影響を確認しやすくなります。

モデル・プロンプト・設定について:Diffusers公式ガイド

広告