ポジティブプロンプトが「見たいもの」を書くものだとすれば、 ネガティブプロンプト はAIが何としても避けるべきものを書くものです。AI画像を始めたばかりの人にもっとも軽視されがちな技術ですが、成功率にも仕上がりの質にも大きく効きます。捨てる生成が減り、プロンプトを「当てにいく」ための時間も短くなります。

ネガティブプロンプトとは正確には何か

Stable Diffusionでは、ネガティブプロンプトは文字どおり独立した入力欄です。メインのプロンプトとは別のテキスト欄に、破綻や不要な要素を表す語を並べます。たとえば blurry, extra fingers, watermark, low qualityといった具合です。モデルは拡散の過程でこのリストを使い、生成をそれらの概念から遠ざけ、書かれた特徴の反対側へ押し出します。

Midjourneyでは同じことをもっと簡潔に、プロンプトの末尾に付ける --no パラメータで行います。たとえば --no text, frame, blur とすれば、文字や枠、ぼけが出る傾向を抑えられます。一方、DALL-E 3やGemini Imageにはネガティブプロンプト専用の欄がありません。これらは内部でプロンプトを書き換えてから画像を生成するため、制御はポジティブプロンプト側で「欲しいもの」をより正確に書くことで行う必要があります。

この技術的な差は、DALL-E 3やGemini Imageが、ユーザーのプロンプトを画像生成モデルへ渡す前に、自動で書き換える中間層を通しているために生まれます。この層はユーザーの意図をより詳しい記述へ「翻訳」しようとするため、除外リストを別立てで効かせるのが難しくなります。Stable DiffusionやMidjourneyのような専用欄がないのは、そのためです。

なぜネガティブプロンプトはこれほど効くのか

ネガティブプロンプトがないと、AIはプロンプトの曖昧な部分をほぼ自由に埋めてしまいます。おなじみの破綻が生まれるのは、まさにその隙間です。崩れた手、文字のふりをした読めない記号、学習データから引き継がれた幽霊のような透かし、あるいは望んでいない画風(写実的な写真が欲しかったのに「デジタルペイント」風になる、など)です。

こうした要素をネガティブプロンプトで明示的に締め出すと、捨てる生成の割合が劇的に下がります。10枚出して「いちばんマシなもの」を選ぶ代わりに、4〜5枚の時点で狙いに近いものが並ぶようになります。時間も、生成クレジットも、従量課金のツールなら実際のお金も節約できます。

もうひとつ、見落とされがちな利点が生成どうしの一貫性です。同じ画風で揃える必要があるシリーズ(カタログの複数商品や、同一ブランドのアバターなど)を作るとき、よく練られたネガティブプロンプトは、生成ごとの結果が通る「幅」を狭め、予測しやすくしてくれます。

この予測しやすさは、納期の厳しい案件でいっそう効きます。使える1枚に行き着くまで何十枚も試す時間がないからです。そうした場面でのネガティブプロンプトは、結果のばらつきを抑えるセーフティネットとして働きます。

効くネガティブプロンプトの組み立て方

1. その画像で起きやすい破綻を見極める

人物のポートレートと、商品写真と、風景では、危ないところがまるで違います。書き始める前に考えてください。その生成器はこの種の画面でどんな失敗をしがちか。ポートレートなら手と人体の構造、商品なら文字と透かし、風景なら彩度の過剰と要素の重複に注意が要ります。

2. 関係の深い語を絞る

長すぎるネガティブプロンプトはモデルを迷わせ、一語ごとの効き目を薄めます。ネットで拾った巨大な汎用リストをそのまま貼るのではなく、いま作ろうとしている画像にとって重要な5〜8語に絞ってください。

3. 曖昧な形容詞ではなく、具体的な技術用語を使う

「悪い」「醜い」といった語で否定するのは避けてください。モデルが使える技術的な情報を含んでいないからです。常に、破綻そのものを具体的に書きます。 blurry (ピントが甘い)、 oversaturated (彩度が高すぎる)、 extra limbs (手足が余分に生える)、 jpeg artifacts (圧縮ノイズ)といった具合です。

4. 試して、少しずつ直す

まず少数を生成し、どの破綻が頻繁に出るかを観察して、次の回にその語を足していきます。ネガティブプロンプトは繰り返しのなかで良くなる道具です。一発で完璧なリストにたどり着くことは、まずありません。

💡 ヒント: 自分用のネガティブプロンプト集を、カテゴリ別(人物、商品、風景、イラスト)に貯めておきましょう。次の案件で時間が浮きますし、画像の種類が変わるたびに一から考え直さずに済みます。

カテゴリ別・そのまま使えるネガティブプロンプト

目的推奨するネガティブプロンプト
人物・ポートレートdeformed hands, extra fingers, asymmetrical eyes, bad anatomy, mutated, disfigured face
写実的な写真cartoon, illustration, 3d render, painting, blurry, low resolution, unrealistic skin
商品・物体watermark, text, logo, cropped, out of frame, low quality, duplicate object
風景oversaturated, unrealistic colors, lens flare, duplicate, distorted horizon
様式化されたアート/イラストphoto, realistic, noise, jpeg artifacts, signature, watermark
建築写真crooked lines, warped perspective, blurry windows, oversharpened

MidjourneyとStable Diffusionの実務上の違い

考え方は同じでも、実装の違いが書き方を変えます。Stable Diffusionでは、拡散の過程においてネガティブプロンプトはポジティブプロンプトと同等の「重み」を持ちます。括弧と数値を使って語ごとの強さを調整することもでき、たとえば (blurry:1.4) と書けば、その語の排除を強められます。

Midjourneyの --no パラメータは、より直接的で粒度が粗い作りです。概念をカンマ区切りで並べるだけで、語ごとの重み付けはできません(語順がわずかに結果へ影響することはあります)。そのぶん扱いは簡単ですが、上級者向けの外科的な制御という点ではStable Diffusionに劣ります。

用語集:よく使うネガティブ語と、それぞれが防ぐもの

始めたばかりの人には、ネガティブプロンプトで使われる英語の技術用語が、まるで別の方言のように見えるかもしれません。以下によく使う語と、実際に何を防ぐのか、そしてどんな画像でとくに効くのかをまとめます。

用語(英語)防げるものとくに効く場面
blurry画像全体のぼけすべてのカテゴリ
low quality / low resolutionざらつきやピクセルの粗さすべてのカテゴリ
extra fingers / extra limbs指や手足が余分に生える人物・ポートレート
bad anatomy人体の比率の崩れ人物・キャラクター
watermark / signature幽霊のような透かしや署名商品・アート
text読めない、意味をなさない文字看板やラベルが写るもの全般
oversaturated不自然に鮮やかすぎる色風景・自然
jpeg artifacts目に見える圧縮ブロック写実的な写真
duplicate意味なく反復する要素風景や、物が多く写る構図
cropped / out of frame画面端の意図しない切れ商品・全身のポートレート
3d render / cartoon3D風・アニメ調になること写実的な写真
lens flare過剰なレンズフレア風景・屋外の写真

実例:同じプロンプトを、ネガティブ有りと無しで

効果を実感するには、ポートレート生成でよくある例を追うのが早道です。たとえば次のようなポジティブプロンプトを、 "editorial portrait of a woman, natural light, confident expression, medium format camera"ネガティブプロンプトなしで走らせると、次のうち少なくともひとつが起きがちです。半分だけ写った手の指が崩れている、左右のイヤリングが揃っていない、あるいは肌の質感だけが不自然につるりとして画面から浮いている。

そこへ、 "deformed hands, extra fingers, asymmetrical earrings, waxy skin, blurry" というネガティブプロンプトを同じポジティブプロンプトに足すと、使える生成の割合ははっきり上がります。100%完璧になるわけではありませんが、一発で使える結果の比率が目に見えて増えます。とくに4枚以上をまとめて生成する場合に効き、満足のいく1枚にたどり着くまでの試行回数が減ります。

ネガティブプロンプトを自動で用意してくれるツール

既定のネガティブプロンプトをあらかじめ用意しているサービスもあり、毎回ゼロから書く手間が省けます。たとえばLeonardo AIは、画質に関する一般的なネガティブ語(低解像度やよくあるノイズを避けるもの)をすべての生成に自動で適用し、ユーザーはその上に案件固有の語を足すだけで済みます。

Stable Diffusionをローカルで動かす定番のインターフェースであるAutomatic1111やComfyUIでは、ネガティブプロンプトを再利用可能なプリセットとして保存できます。先ほど触れた自分用の語彙集を実際に運用する現実的な方法で、生成のたびにリストを貼り直す必要がなくなります。

ネガティブプロンプトでよくある失敗

多いのは、ポジティブプロンプトと真正面から矛盾する語を否定してしまう失敗です。「写実的な犬、やわらかい毛並み」と書きながら、ネガティブ側で "fur" (毛)を弾けば、結果は奇妙で予測不能になります。ひとつの生成過程のなかで、2つの指示が正面衝突するからです。

この手の衝突は思ったより頻繁に起きます。とくに、別の案件のネガティブプロンプトをよく見直さないまま使い回したときです。リストを確定する前に、ポジティブプロンプトを横に並べて読み返し、否定した語が「欲しい」と書いた特徴と真っ向からぶつかっていないかを確かめてください。

もうひとつ多いのが、ネットの汎用リストを文脈に合わせずコピーすることです。写実的なポートレート向けのリストを、様式化されたイラスト生成へ調整なしで持ち込めば、狙った画風から遠ざかります。本当は様式化したかったのに「cartoon」を否定してしまう、といった具合です。

語の数より、その案件の文脈に合わせることのほうが常に重要です。

最後に、初心者の多くはネガティブプロンプトをまったく使わず、すべてをポジティブプロンプトの調整だけで解決しようとします。ある程度は機能しますが、そのぶんポジティブプロンプトは長く複雑になります。ネガティブプロンプトは、まさにその手間を減らすために存在します。「欲しいもの」と「欲しくないもの」を、2本の別々の線に分けてくれるのです。

主要AIツールのネガティブプロンプト対応状況

ツールネガティブプロンプト対応使い方
Stable Diffusion (Automatic1111 / ComfyUI)標準対応(重み付けあり)専用の「Negative prompt」欄
Midjourney標準対応(語ごとの重み付けなし)プロンプト末尾の --no パラメータ
Leonardo AI標準対応(プリセット自動適用)専用欄+ユーザーの追加語
DALL-E 3直接は非対応ポジティブプロンプトで精密に記述する
Adobe Firefly「除外する効果」で部分的に対応詳細設定パネル
Gemini Image / Imagen直接は非対応チャットの往復でポジティブプロンプトを詰める

ネガティブプロンプトで足りないとき:補完する技術

ネガティブプロンプトは繰り返し起きる破綻の多くを片づけますが、万能ではありません。調整してもなお同じ破綻が残るなら、別の仕上げの技術の出番です。

インペインティング

Stable DiffusionやAdobe Fireflyでは、問題のある部分(崩れた手など)だけを選択し、その領域だけを再生成できます。ほかの部分はそのまま残ります。全体としては良く出た1枚を捨てずに、局所的な破綻だけを直したいときにとくに有効です。

ControlNetと構造ガイド

Stable Diffusion系では、ControlNetを使うと外部の参照(ポーズの骨格など)でポーズ、構図、輪郭を導けます。人体の破綻を招く曖昧さが減るので、ネガティブプロンプトの代わりではなく、その補完として働きます。

生成後のアップスケールとシャープ化

低〜中解像度で納得のいく1枚が出たら、アップスケールツールで最終解像度を上げます。ネガティブプロンプトで抑えきれなかった圧縮ノイズが、この段階でさらに減ることもあります。実案件で使う前の、最後のひと手間にあたる工程です。

マーケティングとSNSでの使いどころ

広告、投稿、バナー用の画像を作るマーケティングの現場には、もうひとつ条件が加わります。技術的に破綻がないだけでなく、ブランドの世界観に沿っている必要があるのです。そのため、ネガティブプロンプトには配色や画風の逸脱を防ぐ語がよく入ります。ミニマルで明るい世界観のブランドなら、「neon colors」や「grunge texture」を否定するといった具合です。

もうひとつよく気を配るのが、AIが競合を思わせる要素や、本物らしすぎる架空のロゴを勝手に描き込むことです。「brand logo」「corporate emblem」といった語を入れておくと、商品画像やオフィス風景でこのリスクを下げられます。

プロの制作フローでの使い方

ECのカタログ、キャンペーン、社内の画像ライブラリなど、大量に生成する現場では、ポジティブプロンプトの内容にかかわらず全生成へ適用する「ブランド標準のネガティブプロンプト」を用意するのが普通です。これで最低限の視覚的な統一(たとえば文字や透かしを常に排除すること)が担保され、承認前に一点ずつ目視で確認する手間が減ります。

画像は出せた。あとは仕上げるだけ

ネガティブプロンプトで狙いどおりの1枚が出たら、ImageToolsのAIツールで最後の調整を加えましょう。

AIツールを見る

よくある質問

ネガティブプロンプトはどの画像AIでも同じように効きますか?
まったく同じではありません。Stable Diffusionには専用の入力欄があり、語ごとに重みを細かく調整できます。Midjourneyは --no パラメータで、より直接的なぶん粒度は粗くなります。DALL-E 3とGemini Imageはネガティブプロンプトに標準では対応していないので、ポジティブプロンプト側で欲しい結果をより正確かつ具体的に書くのが得策です。
どんな画風でも同じネガティブプロンプトを使い回せますか?
おすすめしません。写実的な写真向けに組んだネガティブプロンプトは、イラストの生成では邪魔になります。その場合、「cartoon」や「painting」はまさに狙っている効果だからです。画像のカテゴリごとにリストを分け、目指す画風に合わせて調整するのが確実です。
ネガティブプロンプトを使うと生成時間は延びますか?
処理時間への影響はごくわずかで、たいていのツールでは体感できません。画質の向上と、捨てる生成が減ることを考えれば、わずかな処理差は十分に見合います。費用対効果の非常に良い手法です。
特定の語だけ強く効かせることはできますか?
Stable Diffusionならできます。(blurry:1.4) のように括弧で重みを指定すれば、その語の排除をリスト内のほかの語より強められます。Midjourneyには語ごとの重み付けが同じ形では用意されていませんが、--no パラメータ内の語順が結果にわずかな影響を与えることはあります。
全案件で共通の「標準」ネガティブプロンプトを持つ意味はありますか?
文脈によります。個人の試行錯誤なら、画像ごとに専用のネガティブプロンプトを組んだほうが精度は上がります。一方、決まった世界観のもとで大量に生成するチームなら、全生成に共通の「土台」(透かし、文字、低画質を避けるなど)を持たせるほうが、統一感を保ちつつ目視確認の手間を減らせます。
ネガティブプロンプトはインペインティングやControlNetの代わりになりますか?
なりません。ネガティブプロンプトは最初の生成で破綻が出る確率を下げますが、すでに出てしまった1枚の局所的な問題は直せません。インペインティングとControlNetは補完的な技術で、生成後、あるいは生成と組み合わせて使い、ネガティブプロンプト単体では精密に制御できない細部を直したり導いたりします。
ネガティブプロンプトに入れられる語数に上限はありますか?
技術的には、たいていのツールが長いリストを受け付けます。ただし実際には、長すぎるリストは一語ごとの効き目を薄め、語どうしが矛盾した結果を生むことさえあります。考えられる破綻をすべて先回りして並べるのではなく、その画像にとって本当に重要な5〜10語に絞り、最初の数枚で見えた破綻に応じて足していくのが定石です。