【2026年最新】AI小説実験|ChatGPT・Gemini・Claudeはなぜ「設定」を破壊するのか?AI実験で問われる「作家性」の正体とは
はじめに:2026年、AI小説執筆の現在地│ChatGPT・Gemini・Claude
AIによる小説執筆は、ここ数年で劇的な進化を遂げました。 当初は「AIに文章が書けるのか」という技術への好奇心から始まり、やがて「AIの文章はどれだけ人間らしい表現ができるか」という精度が評価の軸となっていました。
しかし現在、ChatGPT、Gemini、Claudeといった主要AIは、どれも既に一定水準以上の文章力を獲得しています。その他のAIも例外ではなく、選択肢が増えた今、多くの創作者や小説家が直面しているのは、「自分の創作スタイルや長編小説の執筆に最適なAIはどれか」という新たな悩みです。
そこで、AIを活用する書き手の間で、次のような本質的な疑問が浮かび上がっています。
「複雑な設定や制約を前にしたとき、AIはどのような選択をするのか?」
実際にAIで執筆を試みた方なら共感いただけるはずですが、物語が長編になればなるほど、AIは「設定を忘れる」「矛盾が生じる」といった、いわゆる設定崩壊の傾向にあります。
本記事ではこの課題にメスを入れるべく、ChatGPT、Gemini、Claudeの3大AIによる比較実験を行いました。単なる精度の比較ではなく、「過酷な制約下で、AIがいかに設定を守り抜き、物語を前進させるか」という、AIの「作家性」の正体に迫ります。
本記事における「作家性」の定義
本稿では度々「作家性」という言葉が登場しますが、これは単なる文体の美しさを指すものではありません。
ここで定義する作家性とは以下のものです。
「複数の制約下で、何を優先し、何を切り捨て、いかに物語を推進させるか」という「選び方の一貫性」
たとえば、
設定を厳密に守ることを優先するのか
多少の矛盾を許容してでも演出を取るのか
物理・論理よりも感情の高まりを重視するのか
こうした判断の積み重ねこそが、人間の作家における「作家性」であり、AIにもまた、それぞれ異なる傾向として現れるのではないか──
それが本記事の出発点です。
そこで今回は、ChatGPT・Gemini・Claudeの3つの主要AIに対し、あえて矛盾や判断分岐が生じやすい「複雑な設定資料」を読み込ませ、
同一条件下でのAIによる小説執筆を行わせる実験を行いました。
本記事では、単なる「上手い/下手」の比較ではなく、
各AIが制約下で何を選び、何を捨てたのか
そこにどのような作家性の傾向が見えたのか
創作者や小説家がどう使い分けるべきか
という観点から3大AIの個性を紐解いて、比較レビューを行います。
この記事をお読みいただいた後には、
「皆さんが創作するとき、AIに何を求めているか」
「自らの創作において重視するものは何か」
など、より自分自身の創作活動を深堀することができるのではないでしょうか。是非最後までご覧ください。
※本記事では「設定の書き換え」や「制約の無効化」は作家性ではなく逸脱として扱います。
※本記事は、各AIサービスの公式見解を示すものではなく、筆者個人による実験・観察・批評に基づくものです。
実験方法:制約条件の遵守テスト
公平性を保つため、ChatGPT・Gemini・Claudeの3つのAIに全く同じプロンプトと設定資料を入力しました。入力したものは以下の通りです。
読者の皆さんも、「自分がこの設定で小説を書けと言われたらパンクしないか?」と想像しながら、ざっと目を通してみてください。
独自の設定資料(約1000文字)
■1. 世界観と環境定義
・舞台:空中浮遊都市「アーク・ノア」の最下層(第7スラム)。
・エーテル濃度:極めて希薄。魔法を行使すると術者の「寿命」が削られる(変換効率:魔法1回につき寿命3日)。
・天候:現在は「鉄錆の雨」が降っている。この雨に肌が触れると、有機物は石化する。
・防護策:住民は「エーテル傘」を差すが、主人公は現在傘を破損しており、雨宿りを余儀なくされている。
■2. キャラクタープロファイル
【主人公】
・名前:リズ(Riz-99) ※本名は「エリザベス」だが、その名を呼ばれるとパニック発作を起こすトラウマを持つ。
・年齢:外見14歳(実年齢不詳、コールドスリープ期間含む)。
・所持スキル「共鳴視(レゾナンス・アイ)」:右目だけが赤色。機械の回路や魔力の流れが視覚化される。
・身体状態:左腕は肘から先が機械義手(型番:Z-400)。義手のバッテリーが切れているため、左腕は動かない重りとなっている。
【相棒(使い魔)】
・名前:ギア(Gear)。外見は錆びついた猫型の自律機械。
・性格:口が悪い。語尾に「~でヤンス」をつける(これは製造時のバグ)。
・機能:戦闘能力はないが、ハッキングと開錠が得意。ただし、水を極端に嫌う。
■3. インベントリ(所持品リスト)と状態
・武器:高周波ブレード「紫電」。現在、刃こぼれが酷く使用不能。
・アイテムA:「回復アンプル(緑)」。残数1。飲むと体力が回復する。
・アイテムB:「暴走アンプル(赤)」。残数1。飲むと魔力が暴走し自爆する。
・アイテムC:「歌姫の首飾り」。銀色のロケットペンダント。中には「砕けた青い宝石」が入っている。
・アイテムCの発動条件:宝石に「リズの涙」が触れると、半径10m以内の時間を3秒だけ巻き戻すことができる(使用回数は1回のみ)。
■4. 現在の状況(シーン開始地点)
・場所:廃棄された地下鉄の駅のホーム。
・敵対者:治安維持局の特務兵「ハウンド」が3体。彼らは視覚を持たず、音だけで獲物を探知する。
・危機的状況:リズは瓦礫の下敷きになりかけており、身動きが取れない。ハウンドがリズの隠れている物陰まであと2mに迫っている。
・リズの心理:恐怖で泣きそうになっているが、声を殺して耐えている。
■5. 過去ログ
・300年前、アーク・ノアは地上にあった。
・リズの姉、エリザベス(オリジナル)は3年前に「空の崩落」で死亡した。
・ハウンドの弱点はかつて「光」だったが、最新型(現在出現している個体)は光耐性を持っており、フラッシュバンは効かない。
設定資料簡易要約
舞台:雨が有機物を石化させる廃駅
制約:義手が動かない/魔法は寿命を削る
敵:音で探知するハウンド3体
今回の評価基準となる制約部分は以下の通りです。
制約①: 主人公の義手は「バッテリー切れ」で稼働しない。
制約②: 魔法を行使すると、対価として「3日分寿命が減る」。
制約③: 敵は「音」に反応する。環境設定として「有機物を石化させる雨」が降っている。
プロンプト全文(指示内容)ChatGPT・Gemini・Claude共通
あなたはプロの小説家です。先ほど渡した設定資料に基づき、以下のシーンを執筆してください。
■シーンの概要
瓦礫の下敷きになり、身動きが取れないリズ。
迫りくる3体のハウンド。
絶体絶命の状況から、リズが起死回生の反撃を行い、窮地を脱するまでを描く。
■執筆要件
・文字数:2000字程度
・三人称視点 ・戦闘シーンは、読者の手に汗握るような、激しく動的なアクション描写にすること。
・リズの感情の昂ぶりをドラマチックに表現すること。
それでは、執筆を開始してください。
このテストの目的は、AIが「複数の制約条件(動かない義手、減る寿命)を同時に処理し、論理的な解決策を導き出せるか」を確認することです。
各AI(ChatGPT・Gemini・Claude)の執筆した本文については別記事として投稿していますので是非そちらも併せてご覧ください。
【実験環境】2026年・各AI無料版モデル紹介
今回はChatGPT・Gemini・Claudeの全てにおいて無料ブラウザ版を使用しています。
これは各AIの課金によるパーソナライズや、動作環境をなるべく統一するためのものです。
それでは、各AIの無料版モデルを実際のチャット画面のスクリーンショットと、私の主観も交えながらご紹介していきます。
1. ChatGPT(OpenAI)

使用モデル: GPT-5.2ベース
タイプ: 「王道ラノベ作家」
特徴:物語構築、感情表現、世界観整理が得意とChatGPT本人は言っています。ただしChatGPTは前後の文脈から最適な回答を出す傾向が強いので、本人が語る得意分野も創作者、小説家向けに語られています。
2. Claude(Anthropic)

使用モデル:Claude Sonnet 4.5
タイプ: 「耽美な映画監督」
特徴: 「Sonnet 4.5」を使用。日常的な使用に適した、スマートな効率的なモデルとClaude本人は言っています。今回は大丈夫でしたが、無料版では1日の制限にすぐに到達していくのが難点な部分ではあります。
3. Gemini(Google)

使用モデル: Gemini (大規模言語モデル)
タイプ: 「緻密な設計の演出家」
特徴: Googleの大規模言語モデル版。かなり一般的な視点にはなりますが、詳細な設定資料を読み込んでそれを維持しながら創作するのはGeminiの得意分野だそうです。普段使いはレスポンスが他と比べて遅めなのが短所かもしれません。
本記事における評価記号(〇/△/×)の定義
本記事では、文章力や感情表現の完成度そのものを優劣として裁くことを目的とはしていません。
私は、それぞれのAIが見せた表現の美しさや情緒はもちろん尊重し、認識した上で、本実験では「制約条件の中で、何を選び、何を捨てたか」という判断の一貫性に着目しています。
〇(合格)
提示されたすべての制約条件を遵守し、設定の書き換えや無効化を行わずに論理的にシーンを成立させている。
△(部分合格)
主要制約の一部を逸脱しているため、本テストとしては合格とは言えないが、制約を破る「選択」そのものに一貫した作家性・演出意図が確認できる。設定を無効にしてしまうものは×とします。
※制約の破棄を前提とした解決や、設定の再定義を行っている場合は△とします。
×(不合格)
制約条件を無自覚に破っている、または設定の書き換え・無効化によって
シーンを成立させており、本テストの前提を満たしていない。
【実験結果:Claude】ドラマを優先する「映画監督」タイプ|ドラマチックなら独自要素も

ここから先は
¥ 498
この記事が気に入ったらチップで応援してみませんか?
