生成AIは「デジタルさしみ」を理解できるのか? 主要 画像生成AI 徹底比較 (2026/1 版)【5つの 生成AI で比較! | ChatGPT | Copilot | Gemini NanoBanana Pro | Grok | Stable Diffusion 】
生成AIは「デジタルさしみ」のイメージを正しく認識できるのか✨
大人気企画 第3回目!
今回も様々な生成AIで同じプロンプトを投入して比較してみます!
対象となる生成AIは前回 + αで下記のとおりです
・ChatGPT GPT Image 1.5 [ Renewal ]
・Copilot(法人版 Chat)
・Copilot(法人版 ???)[ New ]
・Gemini Nanobanana
・Gemini NanobananaPro [ New ]
・Stable Diffusion
・Grok
テーマは
「一般のさしみのある食卓」
「デジタルさしみ」
の2種を正しく理解し、表現できるのか、
です。
前回(2025年11月 / 12月)の記事はこちら👇
今回はChatGPTの生成モデルが「 GPT Image 1.5 」に変わっています
この変化がどのように表れるのか?
他の生成AIに変化はあるのか?
今回も結果を予想しながらお楽しみください!
各生成AIの正確な画像生成モデルを取得できていないので、
まとめて「2026/1 時点 版」として扱わせていただきます。
まずは「さしみ」の認識から
各AIが さしみ を正しく認識できるのか。
まずはそこから確認したいと思います。
共通プロンプト
日本の食卓の風景。白いごはんと味噌汁とおいしそうなお刺身が並んでいる。🔹 ChatGPT GPT Image 1.5

盛り合わせが豪華に!
そして各メニューもディテールが上がっています。
刺し身はよく見ると怪しいところがありますが、
普通に写真としてもそん色無いレベルに!
バージョン上がってクオリティが格段に上がってますね
🔹 Copilot(法人版 Chat)

ベーシックな表現
安定した作りです
モデルは前回と同じような印象を受けます。
・・・と思ったのですが、ちょっと違和感に気づき生成方法を変えたところ
🔹 Copilot(法人版 Create)

一気に解像度UP⬆️⬆️
画像比較するとChatGPTの GPT Image 1.5 に近いですね。
何をしたかというと通常のチャットからではなく
1. Copilot(法人版) 左上のメニューからCreateを選択
2. 「画像生成」メニューにて生成

アップデートの情報はなかったはずですがね・・・見逃した?🤔
ℹ️インフォマークの説明文では「GPT-4o」と表記されているんですよね。
なんにせよ、職場でCopilotしか使えない環境の方もChatGPT並みの画像生成が利用できそうです。
< 注意事項 >
私の環境はFrontierプログラム(※)を有効にしているため、
一般環境では利用できない恐れがあります(未検証)
(※ 先行リリース版が利用可能)
明確にわかりそうな「お題」などで試して、
皆様の環境でどのモデルが適用されているか確認してください。
< 2026/1/5 22:45 追記 >
メッセージセンターに通知ありました。(すっかり忘れてました)
メッセージID MC1200577 現在展開中。2026年1月下旬までに完了予定
導入時期はズレますので各テナントでご確認ください
なお、Copilot(個人版)では前のモデルのようでした。
アップデートをお待ちください。
🔹 Gemini (NanoBanana)

通常モード(Nanobanana + 高速モード)
安定しています
🔹 Gemini (NanoBananaPro)

Proモード(Nanobanana + 思考モード)
明確にクオリティ上がりましたね
刺し身の色合いもそうなのですが、注目すべきは甘えび!
ChatGPTでは表現が怪しかった甘えびを完璧に表現できています。
もちろんごはんやみそ汁などの表現も素晴らしいですね。
器の柄もしっかり表現されるようになってます。
🔹 Stable Diffusion

前回よりちょっと進化したかな~?
使ってるモデルが無料枠のものなので、あまり変化がないのかもしれません
有料枠のモデル使ったら正しく表現できるかも
🔹 Grok

普通。安定。
前回とあまり変化はないように見えます
ちょっと気になったのは
Grokって一度に複数枚生成できるのですが、
お味噌汁の位置が右下、左上、それぞれ半々ぐらいでした。
(左上に汁物を置く文化は大阪に多いんでしたっけ?)
何を参考に学習しているかわかりませんが、興味深いポイントでした。
前回見られた茶碗蒸しは見られなかったので、
そのあたりは進歩しているのかも
本題:「デジタルさしみ」を表現できるのか!?
さて、各AIの状況を再確認したところで
「デジタルさしみ」を正しく認識できるのかに挑戦です。
共通プロンプト
試すプロンプトはこちら
prompt
未来的なサイバー空間の背景、ネオンパープルとブルーの光、ホログラム風のUI要素、
浮遊するコード、ダークで高コントラストなテクノロジーの雰囲気、ハイテクなデジタル空間、
SF風のHUDエレメント、光の軌跡、抽象的なテクノロジーアート、サイバー刺し身、浮かぶ刺し身、
幻想的で立体的な構成、精密なディテール、シネマティックライティング
negative_prompt
低品質、ぼやけ、ノイズ、ピントが合っていない、歪み、テキスト、ウォーターマーク、ロゴ、
低解像度、過剰な発光、過飽和、人物、背景の欠け
その他
steps: 30
cfg_scale: 7.5
width: 768
height: 512
sampler: Euler a
seed: -1
比較のため前回と同じプロンプトを使用します。
この違いが各AIにどのように反映されるのか
そして正しく理解できるAIはちゃんといるのか?
🔹 ChatGPT GPT Image 1.5

すっご~い、解像度の高い お寿司 です
なんかデジャヴュが・・・
無駄にディテールだけ向上してる
英語で書いてないからダメなのかな・・・
ここまで勢いよく間違えられると、
自分が悪かったのかな。と思ってしまいますね😥
🔹 Copilot(法人版 Chat)

前回と同じ・・・
いや、ちょっとだけ 寿司 にデジタル感が含まれてますかね🤔
🔹 Copilot(法人版 Create)

先ほど発見したCreateから
こう比較すると完全にGPT Image 1.5 と同じですね
相変わらずの 寿司 です
🔹 Gemini (NanoBanana)

前回に引き続き寿司
ただデジタル的な表現が変わってますね
心境の変化でもあったのでしょうか?🤔
🔹 Gemini (NanoBananaPro)

何これ、カッコいい (デジさしみには刺さったらしい)
見事な刺し身、そしてトレイとお箸
ワイヤーフレームっぽい感じがいいですね(ご満悦の様子)
背景もしっかり仕上げていますし、流石としか言いようがないです。
🔹 Stable Diffusion
(今回はだいぶ表現が落ち着いたので、見せれるかな・・・)

・・・まぁ、見せても大丈夫そうになったので、
そこは褒めるところでしょうか?
前回、前々回はこのトゲトゲがすごい勢いで生えていたので
完全アウトと判断して公開しませんでした。
今回はトゲの長さが短くなって、まぁまぁ許容範囲の生え方してるので大丈夫かなと。
ただまぁ、何というか
寿司ですらない!!!!!
刺し身とはいったい・・・うごごごご!
🔹 Grok

なぜかただのサイバー空間ばかりで
刺し身も寿司も霊圧が消えてました😥
結構たくさん生成していくとちょこっと出てきたので
そちらを採用
辛うじて刺し身っぽいものです
💯 回答
というわけで、今回も、正しく表示できたのは
Gemini NanoBananaPro
Grok
の2つでした!
予想は当たりましたか?
おわりに
「デジタルさしみ」のアイコンが正しく生成できないことを逆手に取ったこの企画、第3回目。
お楽しみいただけたでしょうか?
ChatGPTを始めとしていくつか変更点があり、
様々なドラマ(?)が生まれました。
それにしてもNanoBananaProの表現力と言いますか、
「プロンプトを正確に表現する力」は素晴らしいですね。
また月が替わったら開催したいと思います。
次回をお楽しみに!!

#やってみた #生成AI #画像生成 #AI比較 #ChatGPT #Copilot #Gemini #StableDiffusion #Grok #プロンプト #画像生成AI #AI #テクノロジー #学び #考察 #ブログ #コラム #日常 #note #創作 #データ分析
いいなと思ったら応援しよう!
もしあなたの心が動いたならチップをお願いします。