
- Lunaを80%、Terraを20%値下げ、Sol Fastを新設
- GPT-5.6 Solが本番カーネルを自律書き換え、コスト20%削減
- 同性能の価格は4カ月で約13分の1に低下
価格改定と新モード
OpenAIは先日、GPT-5.6シリーズの価格を大幅に引き下げたと発表した。Lunaは80%、Terraは20%の値下げで、推論速度を2.5倍に高めた「Sol Fast」モードも追加している。Sol Fastは標準価格の2倍で利用できるが、知能は変わらないとされている。
この値下げは単なるキャンペーンではなく、OpenAIが同日に公開したGPT-5.6の自己最適化に関する成果に裏付けられている。モデルと推論スタック、エージェント実行基盤の効率化を組み合わせた結果だと説明されている。
自己最適化による推論効率化
OpenAIは推論コスト削減のために、GPT-5.6のモデル「Sol」を本番トラフィックの解析に活用した。Solは負荷分散の調整や、自社のTritonやGluon言語で書かれた本番カーネルを自律的に書き換え、エンドツーエンドの配信コストを20%削減したとされる。
また、投機的デコーディングでは、ドラフトモデルの設計と実験を数百回繰り返し、トークン生成効率を15%以上改善。KVキャッシュの管理やバッチ処理の最適化も加え、同じハードウェアでより多くのトークンを処理できるようにした。
エージェント実行基盤の改善
さらに、複雑なマルチステップタスクを処理するツール向けに、Rustで書かれたオーケストレーション層も最適化した。ツールやスキルは必要なときだけ表示する「遅延ディスカバリ」を採用し、ツール出力はデフォルトで1万トークンに制限。コンテキストの肥大化を防いでいる。
プロンプトキャッシュも効率化し、モデルが見る履歴を追記専用にすることで、同じ指示の再計算を避けている。これにより、キャッシュヒット率を高く維持し、繰り返しの計算コストを抑えている。
価格性能比の劇的変化と注意点
この結果、ある観測者は「GPT-5.4のフル性能は4カ月前と同じ水準だが、その価格はLunaでは約13分の1になった」と指摘している。具体的には、GPT-5.4が$2.50/$15だったのに対し、Lunaは$0.20/$1.20だ。年率換算では約2000倍の改善ペースになるという。
OpenAIはChatGPTアプリやCodex CLIの自動レビューをGPT-5.4からLunaに移行し、約10分の1のコストになると見込んでいる。ただし、こうした公的ベンチマークは学習される傾向があり、実世界のタスクと完全に一致するとは限らない点には注意が必要だ。
In other words, roughly four months later, OpenAI is selling March’s full flagship intelligence at about one-thirteenth the token price.
言い換えれば、およそ4カ月後、OpenAIは3月時点のフラッグシップと同等の知能を、トークン価格で約13分の1で販売していることになる。
日本の開発者・IT企業にとっての意味
日本企業がGPT-5.6を利用する際、従来ハイエンドとされた性能を低コストで使えるようになる。特にエージェント型の業務自動化では、コスト制約から導入を見送っていたタスクが十分に採算に乗る可能性がある。一方で、値下げの背景にあるのはOpenAI独自のモデル最適化と実行基盤の改良であり、他社が追従するのは容易ではない。また、ベンチマークで示された改善は実運用と必ずしも一致しないため、自社のワークロードで検証する姿勢が重要になる。
用語解説
- 投機的デコーディング
- 生成候補を並行して推測し、採用率を高めることでトークン生成を高速化する手法。
- KVキャッシュ
- キーとバリューのベクトルを再利用し、以前の計算結果を保持することで推論を効率化する技術。
- プロンプトキャッシュ
- 同じ指示や文脈の計算結果を保存し、再度の処理を省略する仕組み。
- 自己最適化
- AIモデル自身が本番システムのデータを分析し、推論コードや負荷分散を改善すること。
出典
[AINews] GPT 5.6 price cut by 20%-80%: Cost of GPT 5.4 Intelligence dropped 13x in 4 months due to GPT 5.6 recursive self-optimization
企業のAI活用顧問を、いまなら無料で承っています
何から手をつけるか、どこまでAIに任せるか。自社の業務に合わせて一緒に整理します。導入前の相談だけでも構いません。
無料でAI活用の相談をする