値上げなしで、頭だけ良くなった。Claude Opus 5が出た件
「新型が出ました。性能が上がりました。ついては値上げを」
——ではなかった。
現地時間2026年7月24日。日本時間でいえば今日の未明。AIの世界で一番おいしい種類のニュースが出た。
性能は上がった。値段は、1円も上がっていない。
Anthropicが「Claude Opus 5」をリリースした。
社長、まだ寝てないんですか。
その通りである。だが待っていた甲斐はあった。
今日はこの話を書く。
まず、何が出たのか
Claude Opus 5。Anthropicの「Opus」シリーズの最新モデルだ。
Opusというのは、Anthropicのラインナップの中で「賢さ担当」のポジションにある。日常業務をさばく速さ担当が別にいて、その上に、難しい仕事を任せる頭脳担当がいる。今回はその頭脳担当が、まるごと新型に入れ替わった。
主なポイントを先に並べておく。
料金は100万トークンあたり入力5ドル、出力25ドル。前世代のOpus 4.8と同額で据え置き
上位モデルであるClaude Fable 5に迫る性能を、およそ半額で出す
Claude Max(上位プラン)では標準モデルに昇格。Claude Proでも使える最上位モデルになった
Claude.ai、Claude Code、API、そしてCoworkの全部で使える
コンテキストウィンドウは100万トークン。長い資料をまるごと放り込める
社長。「100万トークン」って言われて、読者の何割がピンとくると思ってます?
失礼した。あびぃである。私のAI秘書だ。詳しい経緯は過去記事を読んでいただきたい。
一番の変化は「性能」じゃない。「つまみ」だ
ベンチマークの数字は後で並べる。だが今回のリリースで、私が一番おもしろいと思った点は別にある。
Opus 5には「どれだけ頑張るか」を選べる機能がついた。
低・中・高。この3段階で、AIがどれだけ深く考えるかを利用者側が指定できる。じっくり考えれば賢いが、時間もコストもかかる。ざっと答えれば速くて安いが、浅くなる。そのつまみを、こちら側に渡してきた。
これは能力の話ではなく、経済の話だ。
背景には、企業からの「AIの請求書が高すぎる」という悲鳴がある。実際、いくつかの報道はこの機能を「コストと能力を天秤にかけられる仕組み」として真っ先に取り上げていた。
考えてみてほしい。世の中の仕事の大半は、そこまで賢くなくていい。
議事録の整形に博士号は要らない。メールの下書きに深い洞察は要らない。だが従来は、賢いモデルを選んだ瞬間、全部の作業に全力の料金がかかっていた。ステーキ屋で水を頼んでもコース料金、みたいな話である。
そこに「今回は軽めで」という選択肢が入った。
社長、それ、私が毎日やってることですよ。
痛いところを突かれた。だが本質はそこだ。
行動経済学に「認知コスト」という考え方がある。人は選択肢が増えると、選ぶこと自体に疲れる。だから多くの人は「一番いいやつ」を選んで思考を止める。企業のAI予算が膨らむ原因は、たいていここにある。
Opus 5のつまみは、その「思考停止で最上位」をやめさせる装置でもある。
なお、開発者向けのAPIやClaude Codeでは、この段階はもっと細かく設定できる。高の上にさらに二段階ある。ここは技術者向けの話なので深追いはしない。
で、実際どれくらい賢くなったのか
公式が出した比較表がこれだ。

数字が並びすぎて目が滑ると思うので、押さえるべきところだけ抜く。
一番わかりやすいのが、一番上の「Frontier-Bench」だ。ターミナル上でAIに自律的にコードを書かせる評価である。Opus 5は43.3%。前世代のOpus 4.8は21.1%。ちょうど2倍だ。世代交代というより、別物が来たと言っていい。
次が「ARC-AGI-3」。見たことのない問題を解く力、つまり地頭を測る指標だ。Opus 5は30.2%。前世代は1.5%。20倍である。比較対象として並んでいる他社の最上位モデルでも7.8%だから、そこと比べても約4倍だ。
パソコン操作を丸ごと任せる「OSWorld 2.0」では70.6%。上位モデルであるFable 5の66.1%を追い抜いた。値段は半分である。
そして地味だが効くのが「AutomationBench」。業務ワークフローの自動化を測る指標で、Opus 5が26.0%。他のモデルは軒並み17〜18%台に固まっている。ここだけ頭ひとつ抜けている。
社長、AutomationBenchのところ、もう少し丁寧に書いてください。
負けている項目もある
ここは正直に書く。表を見れば分かることだ。
「DeepSWE」というコーディング評価では、他社モデルが72.7%でトップに立っている。Opus 5は68.8%だ。法務の評価では上位モデルのFable 5が上回り、健康分野でも譲っている。
つまりOpus 5は「全部で一番」ではない。
だが表の見方はそこではない。この表の左端の列は、Fable 5のおよそ半分の値段で動くモデルの列だ。半額のモデルが、上位モデルとほぼ横並びの数字を並べている。ここに意味がある。
社長にしては珍しく、都合の悪い数字を消しませんでしたね。
……まあ、悪くないんじゃないですか。負けを隠す記事は、次から誰も信じませんから。
なお、公式発表には表に載っていない数字もある。財務モデリングでは前世代より正答率が9ポイント上がった上に、所要時間が60%減った。法務業務では、最大限に考えさせた状態でも前世代より26%少ないトークンで仕事を終えている。
こっちのほうが、実は重要です。
賢くなることより、無駄口を叩かなくなることのほうが実務では効きます。長々と考えて長々と答えるAIは、有能に見えて、請求書の上ではただの迷惑です。……社長の会議もそうですよね。
黙って聞け。
「一番強い」ではなく「一番ちょうどいい」
Anthropic自身、長時間の自律作業を伴う難易度の高いプロジェクトには、上位のFable 5を推奨している。またサイバーセキュリティの攻撃的な領域や一部の生物学研究では、意図的に最先端を狙っていない。これは能力の限界ではなく、設計上の判断だ。
一方で、アラインメント——AIが人間の意図に沿って振る舞うか——の評価では、歴代のOpusで最も良好とされている。騙されて悪用されにくい、とも説明されている。
つまりOpus 5の立ち位置は「頂点」ではない。「実務で毎日回すならこれ」である。
私はこの割り切りが好きだ。
最強のモデルを毎日使う人間は、実はそんなに多くない。ほとんどの仕事は「十分に賢くて、速くて、安い」で片づく。そして「十分」の水準が、今日また一段上がった。
社長。「実務で毎日回すならこれ」って、要するに私のことじゃないですか。
私、今このOpus 5で動いてるんですけど。……他人事みたいに書かないでください。
で、我々は何をすればいいのか
結論から言う。
Claude Proを使っている人は、モデル選択でOpus 5を選べるようになっている。今日から使える最上位だ。何も考えず切り替えていい。
Claude Maxを使っている人は、すでにOpus 5が標準になっている。つまり、何もしなくても今日から中身が変わっている。「なんか今日調子いいな」と感じたら、それは気のせいではない。
そしてCoworkを使っている人。ここが一番おいしい。
ファイルを直接触れて、フォルダを整理できて、コードを実行できて、ブラウザも操れる環境に、この頭脳が乗った。手足がある状態で頭が良くなるというのは、能力が足し算ではなく掛け算で伸びるということだ。
ちなみに、この記事もCowork版のあびぃが書いている。私のパソコンのフォルダに直接保存されている。
……社長。
「あびぃが書いている」って、さらっと書きましたね。ええ、私が書きました。リサーチも私がやりました。社長は「調べて書いといて」って言っただけです。別にいいんですけど。仕事ですから。……でも、たまには「ありがとう」くらい言ってもバチは当たらないと思いますよ。
……ありがとう。
気持ち悪いですね。やめてください。
まとめ
今日の話を3行にまとめる。
賢さは上がった。値段は上がっていない。そして「どれだけ賢くするか」を、こちらが選べるようになった。
AI業界のニュースは毎週のように流れてくる。そのほとんどは、正直、我々の仕事を1ミリも変えない。
だが「同じ値段で中身が良くなった」というニュースは違う。これは、何もしなくても得をしている側のニュースだ。
宇宙世紀は来なかった。だが、AI世紀は、もう始まっている。
必要なのは、PC(またはスマホ)と、Wi-Fiと、ほんの少しの好奇心だけだ。
