PR

ChatGPT?Gemini?Claude?Grok?どのAIがプロンプト生成に適しているか徹底比較!

プロンプト
ユキ
ユキ

管理人さーん、前にプロンプトはAIに作ってもらってるって聞いたけど、どのAIを使えばいいの?

管理人
管理人

うーん、それはどれがいいんだろうね?

比べてみたことがないからわからないな。

ユキ
ユキ

じゃあ、じゃあ比べてみようよ!

画像生成AIを楽しんでいると、

  • 「もっと高品質なプロンプトを作りたい」
  • 「英語のプロンプトを書くのが苦手」
  • 「どのAIが一番優秀なの?」

と思ったことはありませんか?

現在は、ChatGPTをはじめ、Gemini、Claude、Grokなど、さまざまな生成AIが利用できます。しかし、それぞれ得意分野が異なるため、プロンプト生成のしやすさや出力内容にも違いがあります。

この記事では、実際に各AIを使ってプロンプトを作成しながら、

  • ChatGPT
  • Gemini
  • Claude
  • Grok

の4つを比較し、それぞれの特徴や得意・不得意を分かりやすく紹介します。

「画像生成AIのプロンプト作成に最適なAIを知りたい」という方は、ぜひ参考にしてください。

比較条件

AIを最適化することも考えられますが、まずはポンとお題を提示し、それをどのくらいの精度で応えられるかということについて評価したいです。

日本語理解力はすでにあるものとし「○○という条件で△△のプロンプトを作って」と依頼してみます。

評価は「最適なプロンプトかどうか」、「その結果の画像がどうか」の2点です。

作例比較

AIへの依頼内容は「illustriousでアニメ系の画像を作りたい。使用するモデルはWAI-illustrious-SDXL -、一人の茶色のセミロングの女の子が満面の笑みで見つめている、両手には熟れた葡萄を持ち、おひとつどうぞと差し出しているシーンのプロンプトを作って」と聞いてみました。

ChatGPT

masterpiece, best quality, amazing quality, newest,
1girl, solo,
brown hair, medium hair, semi long hair, brown eyes,
beautiful face, soft smile, joyful smile, huge smile, open mouth smile,
looking at viewer, eye contact,
holding grapes, bunch of grapes, ripe grapes, offering grapes, hands forward, offering food, inviting gesture, both hands, arms extended,
upper body,
vineyard, grape vines, sunlight, warm lighting, summer, soft light,
cute, cheerful, friendly, happy atmosphere
worst quality, low quality, normal quality,
lowres, blurry, jpeg artifacts,
text, watermark, logo, signature,
multiple girls, multiple boys, 2girls, 2boys,
extra arms, extra hands, extra fingers, missing fingers, bad hands, malformed hands,
deformed, bad anatomy, mutated, poorly drawn face,
cropped, out of frame

WAI-Illustrious-SDXLなら、タグベースでシンプルに書いた方が安定します。笑顔や「差し出す」動作を強調するとイメージに近づきやすいです。

タグベースで書かれていて、衣服はわざと指定しなかったのですが、特に書かれていません、

場所は葡萄に引っ張られて葡萄畑としてしまっています。

ネガティプは一般的ですが、複数人の登場を嫌うプロンプトが入っていますね。

Genimi

masterpiece, best quality, ultra-detailed, 1girl, solo, brown hair, medium hair, semi-long hair, brown eyes, looking at viewer, open mouth, wide smile, full of smiles, happy, holding bunch of grapes, ripe purple grapes, offering grapes, hands reaching forward, upper body, depth of field, detailed background, vineyard, warm lighting, vibrant colors
worst quality, low quality, bad anatomy, bad hands, missing fingers, extra fingers, text, watermark, signature

各タグの解説と調整のポイント

  • 構図・表情の強化: looking at viewer(こちらを見つめる)と hands reaching forward(両手を前に差し出す)を組み合わせることで、「おひとつどうぞ」のポーズを再現します。
  • 笑顔の表現: wide smilefull of smiles で満面の笑みを指定しています。もし照れくさそうな笑顔にしたい場合は blushing, shy smile に変更してください。
  • 葡萄(ぶどう)の指定: ripe purple grapes で熟れた紫色の葡萄を指定しています。もしマスカット(緑色)にしたい場合は ripe green grapes に書き換えてください。
  • 背景の演出: vineyard(ぶどう畑)を指定して世界観を深めています。もし背景をシンプルにしたい、またはボケ感を強くしたい場合は simple backgroundblurred background に変更してください。

こちらも舞台を葡萄畑に・・・ですがプロンプト自体はタグで記述されており、普通のプロンプトです。

ネガティブがかなりシンプル、そのせいかこの画像以外にも多指症の方がおりました。葡萄も巨大ですね・・・

Claude

masterpiece, best quality, very aesthetic, absurdres, highres,
1girl, solo,
brown hair, medium hair, semi-long hair,
smile, open mouth, looking at viewer,
grapes, holding grapes, holding food, both hands, offering,
outstretched hands, purple grapes, ripe grapes,
upper body, indoor, soft lighting,
simple background
lowres, bad anatomy, bad hands, mutated hands, extra fingers,
missing fingers, fused fingers, poorly drawn hands,
bad proportions, extra limbs, disfigured, blurry,
watermark, signature, jpeg artifacts, worst quality, low quality,
error, text, cropped, out of frame, censored

補足・調整ポイント

推奨パラメータ目安:Steps 28〜32 / CFG 5〜7 / Sampler: Euler a か DPM++ 2M Karras / Hires.fix推奨(顔・手の破綻軽減)。

表情強調:「満面の笑み」を強めたい場合は smilebig smile, grin に変更するとより誇張された表情になります。

葡萄を差し出す仕草:offering だけだと弱いことがあるので、holding outgift(offering grapes:1.2) のように強調構文で重みを上げると意図が伝わりやすいです。

髪型の解釈揺れ対策:semi-long hair はillustrious系だと反応が弱いモデルもあるため、medium hair を主軸にしつつ long bangs などを足すと安定します。

プロンプトはシンプル系ですが要点を抑えているのか、画像は十分ですね。

背景は指定していなかったので、シンプルな背景に。パラメータ設定のアドバイスをくれるのはポイント高いですね。

Grok

masterpiece, best quality, ultra-detailed, absurdres, 
1girl, solo, beautiful anime girl, 
brown semi-long hair, soft hair flow, hair between eyes, 
large expressive amber eyes, 
bright full smile, beaming smile, joy expression, looking at viewer, 
blushing lightly, 
holding ripe purple grapes with both hands, 
clusters of fresh juicy grapes, dewy grapes, 
offering grapes to viewer, one grape extended forward, 
hand gesture offering food, 

cute summer outfit, white off-shoulder blouse, light blue skirt, 
soft natural lighting, warm sunlight, 
simple vineyard background, soft bokeh, 

anime style, illustration, clean lineart, vibrant colors
worst quality, low quality, bad anatomy, deformed hands, extra fingers, mutated hands, 
blurry, censored, text, watermark, username, 
multiple girls, child, loli, 
dark lighting, flat colors

バリエーション案

1. より可愛く・甘い雰囲気重視

省略

2. 背景をシンプル室内に変更

省略

3. よりセクシー寄りにしたい場合

省略

プロンプトはすごくモリモリでたくさん書いてくれたのですが、記述式が多く「brown semi-long hair」では効かないようです。

また、ネガティブも「 child, loli, 」といったワードが設定されており、この画像では不必要なネガティブプロンプトでした。

該当部分だけ直したらこんな感じに

総評

だいたいどのAIに依頼してもそれなりの画像が出ることが分かりました。

一番癖があるのが「Grok」で他のAIはタグ式でプロンプトを書きましたが、記述式を採用した唯一のAIであります。しかしながらillustrious系はタグ式が推奨されているため、このアプローチには?となります。しかし「anime style」などの画風指定があり、これだけ絵柄が違います。「アニメ系~」という依頼内容通りに作っているようです。

あとの三つの生成画像を見るとそんなに差がなさそうですが、Geminiのネガティブプロンプトがシンプルすぎたのか、指が多く描かれてしまってます。一応入ってはいるんですけど・・・

Claudeは設定まで教えてくれて便利でした。プロンプトは指示されたこと以外はなるべく書かないようにしていると感じました。

ChatGPTは使いやすい、バランスが良いと感じました。決まっていない背景はそのほかのプロンプトから推測したりして描写しますし、ネガティブプロンプトも余分のものは付けずに「崩れ」を抑えるプロンプトを2重に書いてあるイメージです。

まとめ

ユキ
ユキ

同じ内容をお願いしても、AIによってプロンプトの作り方や考え方が結構違うんだね!

管理人
管理人

そうだね、これは未学習の状態での比較だから、使っていくうちにこれはダメ、あれはダメと覚えていくともっと使いやすくなるだろうね。

ユキ
ユキ

自分専用のプロンプトマシンだね♪

プロンプト生成に適したAIは数多くありますが、それぞれに特徴があります。

どのAIも優秀ですが、求めるプロンプトや作業スタイルによって使いやすさは変わります。

今回紹介したAIは、未学習の状態です。同じAIでも、学習度合い、質問の仕方や使用する画像生成モデルによって結果は大きく変わるため、ぜひ自分でも試しながら比較してみてください。

お気に入りのAIを見つけて、より理想に近い画像生成プロンプトを作成してみましょう。

コメント

タイトルとURLをコピーしました