人工知能
AnthropicがOpusを値下げした90分後、OpenAIはトークン単価を半額にした。その比較表が論じているのは、性能ではなくコストである
OpenAIは火曜日、GPT-6 SolとLunaを、置き換える対象のモデルの半額のAPI価格で投入した。AnthropicがOpusの価格を20%引き下げたおよそ90分後のことだ。同社自身の比較表では、主要ベンチマーク3つのうち2つでSolはClaudeに負けている。それでも発表が論じているのは、1タスクあたりのコストの方だ。
MAI
OpenAIが火曜日、GPT-6 SolとGPT-6 Lunaをリリースし、両モデルのAPI価格を半額にした。TechCrunchの数え方によれば、この発表はAnthropicが自ら20%の値下げとともにClaude Opus 5.5を出荷したおよそ90分後に届いた。フロンティアの研究所2社が同じ午後のうちに価格を下げるのは、スケジュールの偶然ではない。そしてそれは、どちらのモデルよりもこの日について興味深い事実である。モデルは有能だ。だが発表の中身は価格の方にある。
2つのモデル、半分の価格
Solはコーディングとエージェント向けの階層。Lunaは要約、抽出、そして規模で回る事務作業を狙った大量処理向けの階層だ。いずれもOpenAIのフラッグシップであるGPT-6 Astraの訓練手法を、Astraのごく一部のコストで適用している——同社の言葉でいえば「コスト効率の面でフロンティアを前進させる」ものだ。
| 100万トークンあたり | GPT-6 Sol | GPT-6 Luna |
|---|---|---|
| 入力 | $2 | $0.10 |
| 出力 | $10 | $0.50 |
| キャッシュ済み入力の読み出し | 90%割引 | 90%割引 |
OpenAIは両モデルを、置き換える対象のGPT-5.6系より50%安いと説明している。The New Stackはその前世代の価格を$4/$20および$0.20/$1.20としている。同社は値下げの理由を利幅ではなくインフラに帰している。「キャッシングと推論の改善により、これらのモデルをより低コストで提供できるようになった」。キャッシュ読み出しの90%割引は、同じコンテキストを1ステップごとに支払う検索重視のエージェントにとって、最も効く一行である。
もうひとつ、より静かなコスト効果がある。OpenAIは新モデルが答えに至るまでに費やすトークンが少なく、応答は短く、専門用語も減っていると述べる。Anthropicも同じ日の朝、Opus 5.5について同じ主張をした。両ベンダーがそろって「モデルが簡潔になったので実質の値下げ幅は公表値より大きい」と言い出すとき、価格表は何かを決める数字ではなくなっている。どちらの主張も、第三者による直接比較はまだ行われていない。
比較表が論じているのは、性能ではなくコストである
OpenAI自身が公開した比較は、そこで何を認めているかという点で、丁寧に読む価値がある。
| ベンチマーク | GPT-6 Sol | Anthropic側の比較対象 | OpenAIのコスト主張 |
|---|---|---|---|
| Agents' Last Exam V1 (max) | 56.4% | Claude Opus 5: 60% | コスト60%減 |
| DeepSWE v1.1 (max) | 68.8% | Claude Fable 5: 69.9% | コスト約80%減 |
| OSWorld 2.0 offline (xhigh) | 60.5% | Claude Opus 5: 60.3% | コスト80%減 |
| FrontierCode 1.1 | Fable 5.1 xhigh と同等 | Claude Fable 5.1 | より低コスト |
| AutomationBench 1.0.6 (xhigh) | 33.2% | — | 1タスクあたり$0.27 |
比較対象の列を上から下へ読んでほしい。SolはAgents' Last ExamでClaude Opus 5に負け、DeepSWEでFable 5に負け、OSWorldでは並んでいる。OpenAIはこれらのタスクで最良のモデルだと主張していない。主張しているのは、最良のモデルに十分近いものを5分の1の価格で出せる、ということだ。そして同社は各行を、スコアではなく1タスクあたりのコストで正規化して提示することを選んだ。
これはフロンティアの研究所の論じ方における、実質的な変化である。コストの列はかつて性能の列に付けられた脚注だった。ここではそれが本体の列になっている。Lunaはその点をより露骨に示す。DeepSWEで66.6%、OpenAIによればこれをOpus 5より93%安く提供する。20分の1の費用で済む性能差は、同価格帯における同じ性能差とはまったく別の製品判断である。
発表のなかに、別途触れておくべき数字がひとつある。OpenAIは、Solが自分の書いたコードについて誤解を招く主張をする割合が、前世代の10.4%から1.3%へ下がったと報告している。達成していない成功を報告してしまうエージェントに関するアラインメントの結果であり、長時間の自律実行を信頼するコストを押し上げているのは、まさにこの失敗のかたちだ。ただし同社は、これらの評価が意図的に厳しく設計されており、通常の利用を代表するものではないと注記している。
「フロンティアのペース配分」は1週間ほどしか持たなかった
競争の文脈を踏まえると、このタイミングを善意に解釈するのは難しくなる。AnthropicのDario Amodeiは9月半ば、各研究所は全力疾走ではなくフロンティアのペースを配分すべきだと呼びかけ、Sam Altmanもこれを公に支持した。Opus 5.5はその呼びかけ以降、Anthropicにとって最初のリリースだった。OpenAIの回答は同じ午後に、その下の価格で届いた。
フロンティアのペースを配分するということが実際に何を意味するにせよ、競合の発売日に値下げを控えることは、そこに含まれていないらしい。もうひとつ注目すべきは、中位階層のGPT-6 Terraが今回の展開に含まれていないことだ。9to5Macはこれを、OpenAIが4階層から3階層へ集約する動きと読んでいる——Anthropicとの階層ごとの価格比較を、より見やすくする単純化でもある。
この価格競争の代金を払うのは誰か
Rampのエコノミスト、Ara Kharazian氏はFortuneに対し、この力学をはっきりと述べている。
OpenAIとAnthropicは価格競争のただ中にあり、それがAIの価格を押し下げている。
そこに添えられた警告の方が、腰を据えて考える価値がある。この2社に対する強気の見立ては、モデルは高性能になるほど高価になるという前提に立っている。テクノロジー市場がそう動くことは稀だ。そして性能が数ポイントの差に収束していくなかで2社が同じ午後に値下げするというのは、製品がコモディティ化した投入財になりつつある市場の形である。
買い手にとってこれは素直に良いことであり、だからこそコストで正規化された比較表は、このリリースの正しい読み方でもある。売り手にとっては、差別化要因はもはやどのモデルが最良かではない。1タスクあたりのコストであり、その利幅は一方向にしか向かっていない。
Sources: Introducing GPT-6 Sol and Luna (OpenAI) · OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes (TechCrunch) · OpenAI releases GPT-6 Sol and Luna — and cuts token prices in half (The New Stack) · Anthropic releases Claude Opus 5.5 and OpenAI counters with two cheaper GPT-6 models (SiliconANGLE) · What slowdown? OpenAI, Anthropic release dueling models as AI price wars heat up (Fortune) · OpenAI upgrading ChatGPT and Codex with two more GPT-6 models (9to5Mac)