いろは堂AI ← 戻る

画像生成AIの始め方|最初の1枚をどう直す?

2026年7月18日|いろは堂AI編集部
室内でノートパソコン画面に草原と車の画像編集ソフト画面が映っている様子

画像出典: alexx-ego / Pixabay

この記事の要点
画像生成AIは「主題+詳細描写+スタイル+技術的指定」の順で書くと狙いに近づきます。無料で試すならBing Image Creator、ChatGPT Plus契約中ならDALL-E 3が追加料金なしで使えます。思い通りに出ないときは一度に全部直さず、1回につき1箇所だけ変えて、変えた言葉と出てきた絵を記録していくのが近道です。
😟
画像生成AIって面白そうだけど、どこで何を打てばいいのか全然わからない…

画像生成AIは、絵を描く道具というより言葉で注文する道具です。上手い人と初心者の差は、絵心ではなく「注文の書き方」と「直し方」の差でしかありません。

正直なところ、最初の一枚はほぼ確実にイメージと違うものが出てきます。それは失敗ではなく、仕組み上そうなるのが普通です。大事なのは、出てきた絵を見て「どこをどう直すか」を1つずつ決められること。ここでは、最初の一枚を出すところから、狙いに近づけるまでの流れをまとめます。

画像生成AIは何をしているの?

画像生成AIは、大量の「画像とその説明文」の組み合わせを学習しています。ざっくり言うと、ノイズ(砂嵐のような画面)から出発して、入力された言葉に合いそうな方向へ少しずつノイズを取り除いていくという作り方をしています。真っ白なキャンバスに描き足すのではなく、砂嵐から像を彫り出すイメージです。

ここが最初のつまずきポイントになります。AIは、あなたの頭の中にある完成図を知りません。知っているのは「入力された言葉に近い画像は、だいたいこういう見た目だった」という統計的な傾向だけです。

🤔
「かっこいい絵」って打ったのに、なんか普通の絵が出てきた…

言葉が曖昧なほど、AIは「その言葉に合う無数の候補」の平均的なところを選びます。曖昧な指示ほど、無難で平凡な絵に着地するのはこのためです。逆に言えば、具体的に書くほど候補が絞られ、狙いに近づきます。曖昧な指示では望む結果を得にくく、具体的で詳細な指示が重要だとされているのは、この性質によるものです。

最初の1枚はどのツールで出せばいい?

趣味で始めるなら、いきなり有料契約をする必要はありません。手持ちの環境で決めてしまうのがいちばん早いです。

まずはここから選ぶ
  • とにかく無料で試したい → Bing Image Creator(Microsoft提供)。1日の生成回数に制限はありますが、始めるには十分です
  • すでにChatGPT Plusを契約している → DALL-E 3が追加料金なしで使えます
  • 画質にこだわりたい → Midjourney。最も高品質とされますが、有料サブスクリプションが必要です

Midjourneyは有料サブスクリプションでの利用が前提で、無料で試す枠はありません。趣味で始める段階なら、まず無料または手持ちの契約で使えるものを触ってから検討して十分です。料金や利用条件は変わることがあるため、申し込む前に公式サイトで最新のプランを確認してください。

プロンプトはどう書けばいい?

AIへの指示文はプロンプトと呼びます。書き方に決まった正解はありませんが、「主題 + 詳細描写 + スタイル + 技術的指定」の順で組み立てると効果的だとされています。

  1. 主題何を描くか。「猫」「カフェで本を読む女性」など、画面の中心にあるもの。
  2. 詳細描写その主題の動作・状態・表情・服装・持ち物など。「白い長毛の猫が、窓辺で丸くなって眠っている」。
  3. スタイル画風の指定。「油絵スタイル」「アニメ調」「水彩画風」など。
  4. 技術的指定光や構図、画質に関する指定。「柔らかい自然光」「背景はシンプル」など。

この並びは、何を描くかを先に決め、そのあとで見え方を足していく順番になっています。被写体と、その動作・状態・表情を具体的に組み合わせるほどイメージに近づくとされているので、まず主題と詳細描写をしっかり書き、画風や光の指定はそのうえに重ねると考えるとまとまりやすくなります。

実際に打つと、同じ「猫の絵」でも渡している情報の量がここまで違います。

指示の要素言葉が足りない例言葉が足りている例
プロンプト全文かわいい猫の絵白い長毛の猫が窓辺で丸くなって眠っている、柔らかい水彩画スタイル、朝の自然光、背景はシンプル
主題白い長毛の猫
詳細描写指定なし(AIが平均で補う)窓辺で丸くなって眠っている
スタイル指定なし(AIが平均で補う)柔らかい水彩画スタイル
技術的指定指定なし(AIが平均で補う)朝の自然光/背景はシンプル

上の表で「指定なし」と並んでいる行が、そのままAIの裁量になる部分です。2つの違いは、絵のセンスではなくAIに渡した情報の量にあります。前者でAIが読み取れるのは主題の1語だけで、猫の種類も姿勢も画風も統計的な平均から埋められます。「かわいい」という言葉は、絵の情報を何も足していません。後者では姿勢・光・画風が言葉で指定されているぶん、候補が絞られます。

日本語で通るツールも増えましたが、英語で書いたほうが安定する場面は今でもあります。日本語で出してみて崩れるようなら、同じ内容を英語に置き換えて試す価値があります。

思い通りに出ないときはどう直す?

😮‍💨
直そうとして色々書き足したら、前より変な絵になった

一度にたくさん直すのは、いちばん遠回りになります。プロンプトを何箇所も同時に変えると、どの変更が効いたのかわからなくなるからです。1回で完成を狙わず、修正前提で詰めるのが結果的に速い進め方です。出力を見て、問題点を1つだけ直していきます。

そのうえで、直す前に「この崩れは3種類のどれなのか」を見分けると手が決まります。画像生成AIで起きる不満は、だいたい次の3つに分かれます。

崩れの3分類と、それぞれの打ち手
  • 言葉が足りていない(AIが平均で埋めた)→ 足りない情報を書き足す。全体が暗いなら「soft natural light」、背景がごちゃごちゃするなら「simple background」、文字が読めないなら「bold readable Japanese text」のように、欲しい状態を1つだけ言葉にする
  • いらない方向に寄っている(学習した傾向に引っ張られた)→ 除外指定で外す(次の項目)
  • AIが苦手な領域に踏み込んでいる(手・指・細かい文字・複雑な構図)→ 言葉では直りきらないので、構図そのものを変えて避ける

1と2は言葉で解決できますが、3は言葉を足すほど泥沼になります。直せる崩れと、避けるべき崩れを分けて考えると、無駄な試行が一気に減ります。

そして変更は1回につき1箇所だけにして、「変えた言葉」と「出てきた絵」をセットでメモに残します。これをやっている人とやっていない人で、上達の速さがいちばん変わります。同じ失敗を二度繰り返さずに済むからです。

ネガティブプロンプトで「入れたくないもの」を伝える

多くのツールには、除外したい要素を指定する欄があります。これをネガティブプロンプト(描いてほしくないものを列挙する指示)と呼びます。よく使われる指定はこの並びです。

blurry, low quality, watermark, text, deformed, bad anatomy, extra fingers

含めたくない要素を明示的に指定すると生成画質が向上するとされています。AIは学習した傾向をなぞって絵を作るため、寄ってほしくない方向を言葉で外しておくと、狙いから遠い候補が減るという理屈です。

それでも崩れやすい部分があります

手や指、細かい文字、複雑な構図は崩れやすい部分で、除外指定が有効とされていますが、それでも崩れることがあります。崩れる前提で、手を大きく写さない構図にする・人数を減らすといった逃げ方も覚えておくと楽になります。

趣味として続けるためのコツは?

上達の実感がいちばん出やすいのは、うまくいったプロンプトを残しておくことです。生成した画像と、そのとき打った文をセットでメモしておくと、次に似た絵を作るときの出発点になります。ゼロから書き直すのと、前回の文を1行だけ変えるのとでは、かかる手間が全く違います。

最初の1週間でやってみること
  • 同じ主題で、スタイル指定だけを「水彩画風」「アニメ調」「油絵スタイル」の3種類に変えて出し、3枚を並べて見比べる
  • 気に入った1枚を選び、背景の指定だけを変えて出してみる
  • うまくいった文をメモに貼り、自分用のテンプレにする

1つ目がとくにおすすめです。変えたのはスタイルの一語だけなのに、絵全体の印象がまとめて入れ替わることが、自分の目で確認できます。「◯◯風」の一語がどれだけ絵を動かすかは、説明を読むより、自分で3枚出して並べたほうが一度で腑に落ちます。ここを体感しておくと、次から指示の当たりをつけやすくなります。

🤩
1枚出すたびに、次に何を書けばいいかがわかってきた気がする

画像生成AIは、正解を当てるゲームではなく、言葉と絵の対応を少しずつ手に入れていく作業です。最初の一枚が思い通りでなくても、それは狙いを絞り込むための一歩目にすぎません。まずは1枚、無料で出せるところから触ってみてください。

なお、生成した画像を公開したり配布したりする場合は、使うツールの利用規約で商用利用や権利の扱いを確認しておくと安心です。ツールごとに条件が異なります。

よくある質問

画像生成AIは無料で始められますか?

始められます。Microsoftが提供するBing Image Creatorは無料で利用でき、1日の生成回数に制限はあるものの基本的な用途には十分とされています。ChatGPT Plusを契約している場合は、DALL-E 3を追加料金なしで使えます。

プロンプトはどんな順番で書けばいいですか?

「主題 + 詳細描写 + スタイル + 技術的指定」の順で組み立てると効果的とされています。まず何を描くかを置き、その状態や表情を具体化し、続いて画風、最後に光や構図の指定を書きます。

生成した絵の手や指が崩れるのはなぜですか?

手や指、細かい文字、複雑な構図は画像生成AIが崩しやすい部分だとされています。ネガティブプロンプトで「deformed, bad anatomy, extra fingers」を除外指定すると改善しやすくなりますが、完全には防げないため、手を大きく写さない構図に変えるのも有効な回避策です。

思った絵が出ないとき、プロンプトはどう直せばいいですか?

一度に複数箇所を変えず、1回につき1つだけ直すのが基本です。崩れが「言葉が足りない」「いらない方向に寄っている」「AIが苦手な領域」のどれかを見分け、足りないなら欲しい状態を1語足し、寄っているならネガティブプロンプトで外し、苦手領域なら構図そのものを変えて避けます。

※記事で使用した内容・数値は変更される場合があります。最新情報は公式サイトをご確認ください。