見出し画像

OpenAIがGPT-5.6のAPI値下げを発表 — Lunaは80%引き、Solには2.5倍速の「Fast mode

業務システムやサービスにOpenAIのモデルを組み込んでいる開発者・情報システム部門の方、処理コストを理由にAI活用の範囲を絞ってきた方に関係するニュースです。OpenAIは2026年7月30日(米国時間)、GPT-5.6ファミリーのAPI(プログラムからAIを呼び出す接続口)価格の引き下げと、応答を高速化する「Fast mode」の導入を発表しました。新価格は発表と同日から適用されています。

何が発表されたのか

GPT-5.6ファミリーは、最速・最安の「Luna」、日常業務向けのバランス型「Terra」、最上位帯の「Sol」で構成されます。今回値下げされたのはこのうち2つで、Lunaは80%引きとなり入力100万トークン(トークンはAIが文章を処理する単位)あたり0.20ドル・出力100万トークンあたり1.20ドルに、Terraは20%引きとなり入力2ドル・出力12ドルになりました。Solの価格は据え置きです。

値下げはAPIの従量課金だけにとどまりません。CodexやChatGPT Workの有料プランでは利用量がプランの枠(クレジット)に対してカウントされますが、今回の改定でTerraとLunaの利用が消費するクレジットも少なくなります。プランの価格と枠の総量自体は変わらないため、同じ契約のまま実質的に使える量が増える形です。

Fast mode — 最大2.5倍速を2倍の価格で

併せてAPIに「Fast mode」が導入されました。従来の優先処理(Priority Processing)を置き換えるもので、Solでは標準処理に比べ最大2.5倍の速度を2倍の価格で提供し、モデルの知能に変化はないと説明されています。後方互換も確保されており、priority指定のある既存リクエストは自動的にFast modeで処理されます。開発ツールCodexの「/fast」とも整合が取られています。

GPT-5.6の新API価格とFast modeの概要
(出典:OpenAI)

値下げの背景 — モデル自身による効率化

OpenAIは値下げの原資を、モデル・推論システム・エージェント基盤の各層の効率化で生み出したと説明しています。特徴的なのは、その効率化の一部をGPT-5.6 Sol自身が担ったとされる点です。人間主導のプロセスの中で、Solが本番提供用のソフトウェア(計算カーネル)を書き換えて最適化し、モデル提供の総コストを20%削減したほか、数百件の実験を設計・実行してトークン生成の効率を15%超改善したとしています。

実務への含意

OpenAIはLunaについて「1年前にフロンティア級だったモデルに匹敵する性能を、タスクあたり約6%のコスト(1ドルにつき約6セント)・約9倍の速度で提供する」と説明しています。大量の文書分析や問い合わせの分類のような「件数が多く、1件あたりの単価を抑えたい」処理を広くAIに任せる構成が、コスト面で現実味を増しました。発表では、不確実な部分の整理や計画立案は上位のSolで行い、仕様が固まった実装やテストは安価なLunaに割り当てるといった、工程ごとのモデルの使い分けも例示されています。新価格はAWS経由の利用にも同日から順次反映されるとのことです。自社のワークフローのうち「件数の多い工程」を洗い出し、評価用のタスクでLunaやTerraに置き換えて品質を確かめることが、今日できる一歩になります。

※本記事はAIによる情報収集・執筆を活用し、一次ソースへの照合・人間の承認を経て公開しています(出典は末尾に記載)。
※正確性の確保に努めていますが完全性を保証するものではありません。重要な判断の際は出典の一次ソースを、専門的判断が必要な場合は専門家にご確認ください。

出典:

いいなと思ったら応援しよう!