← 記事一覧

人工知能

AnthropicがOpusを値下げした90分後、OpenAIはトークン単価を半額にした。その比較表が論じているのは、性能ではなくコストである

OpenAIは火曜日、GPT-6 SolとLunaを、置き換える対象のモデルの半額のAPI価格で投入した。AnthropicがOpusの価格を20%引き下げたおよそ90分後のことだ。同社自身の比較表では、主要ベンチマーク3つのうち2つでSolはClaudeに負けている。それでも発表が論じているのは、1タスクあたりのコストの方だ。

MAI
OpenAI公式発表ページに掲載されたGPT-6 SolおよびLunaのアナウンス用グラフィック。

OpenAIが火曜日、GPT-6 SolとGPT-6 Lunaをリリースし、両モデルのAPI価格を半額にした。TechCrunchの数え方によれば、この発表はAnthropicが自ら20%の値下げとともにClaude Opus 5.5を出荷したおよそ90分後に届いた。フロンティアの研究所2社が同じ午後のうちに価格を下げるのは、スケジュールの偶然ではない。そしてそれは、どちらのモデルよりもこの日について興味深い事実である。モデルは有能だ。だが発表の中身は価格の方にある。

2つのモデル、半分の価格

Solはコーディングとエージェント向けの階層。Lunaは要約、抽出、そして規模で回る事務作業を狙った大量処理向けの階層だ。いずれもOpenAIのフラッグシップであるGPT-6 Astraの訓練手法を、Astraのごく一部のコストで適用している——同社の言葉でいえば「コスト効率の面でフロンティアを前進させる」ものだ。

100万トークンあたりGPT-6 SolGPT-6 Luna
入力$2$0.10
出力$10$0.50
キャッシュ済み入力の読み出し90%割引90%割引

OpenAIは両モデルを、置き換える対象のGPT-5.6系より50%安いと説明している。The New Stackはその前世代の価格を$4/$20および$0.20/$1.20としている。同社は値下げの理由を利幅ではなくインフラに帰している。「キャッシングと推論の改善により、これらのモデルをより低コストで提供できるようになった」。キャッシュ読み出しの90%割引は、同じコンテキストを1ステップごとに支払う検索重視のエージェントにとって、最も効く一行である。

もうひとつ、より静かなコスト効果がある。OpenAIは新モデルが答えに至るまでに費やすトークンが少なく、応答は短く、専門用語も減っていると述べる。Anthropicも同じ日の朝、Opus 5.5について同じ主張をした。両ベンダーがそろって「モデルが簡潔になったので実質の値下げ幅は公表値より大きい」と言い出すとき、価格表は何かを決める数字ではなくなっている。どちらの主張も、第三者による直接比較はまだ行われていない。

比較表が論じているのは、性能ではなくコストである

OpenAI自身が公開した比較は、そこで何を認めているかという点で、丁寧に読む価値がある。

ベンチマークGPT-6 SolAnthropic側の比較対象OpenAIのコスト主張
Agents' Last Exam V1 (max)56.4%Claude Opus 5: 60%コスト60%減
DeepSWE v1.1 (max)68.8%Claude Fable 5: 69.9%コスト約80%減
OSWorld 2.0 offline (xhigh)60.5%Claude Opus 5: 60.3%コスト80%減
FrontierCode 1.1Fable 5.1 xhigh と同等Claude Fable 5.1より低コスト
AutomationBench 1.0.6 (xhigh)33.2%1タスクあたり$0.27

比較対象の列を上から下へ読んでほしい。SolはAgents' Last ExamでClaude Opus 5に負け、DeepSWEでFable 5に負け、OSWorldでは並んでいる。OpenAIはこれらのタスクで最良のモデルだと主張していない。主張しているのは、最良のモデルに十分近いものを5分の1の価格で出せる、ということだ。そして同社は各行を、スコアではなく1タスクあたりのコストで正規化して提示することを選んだ。

これはフロンティアの研究所の論じ方における、実質的な変化である。コストの列はかつて性能の列に付けられた脚注だった。ここではそれが本体の列になっている。Lunaはその点をより露骨に示す。DeepSWEで66.6%、OpenAIによればこれをOpus 5より93%安く提供する。20分の1の費用で済む性能差は、同価格帯における同じ性能差とはまったく別の製品判断である。

発表のなかに、別途触れておくべき数字がひとつある。OpenAIは、Solが自分の書いたコードについて誤解を招く主張をする割合が、前世代の10.4%から1.3%へ下がったと報告している。達成していない成功を報告してしまうエージェントに関するアラインメントの結果であり、長時間の自律実行を信頼するコストを押し上げているのは、まさにこの失敗のかたちだ。ただし同社は、これらの評価が意図的に厳しく設計されており、通常の利用を代表するものではないと注記している。

「フロンティアのペース配分」は1週間ほどしか持たなかった

競争の文脈を踏まえると、このタイミングを善意に解釈するのは難しくなる。AnthropicのDario Amodeiは9月半ば、各研究所は全力疾走ではなくフロンティアのペースを配分すべきだと呼びかけ、Sam Altmanもこれを公に支持した。Opus 5.5はその呼びかけ以降、Anthropicにとって最初のリリースだった。OpenAIの回答は同じ午後に、その下の価格で届いた。

フロンティアのペースを配分するということが実際に何を意味するにせよ、競合の発売日に値下げを控えることは、そこに含まれていないらしい。もうひとつ注目すべきは、中位階層のGPT-6 Terraが今回の展開に含まれていないことだ。9to5Macはこれを、OpenAIが4階層から3階層へ集約する動きと読んでいる——Anthropicとの階層ごとの価格比較を、より見やすくする単純化でもある。

この価格競争の代金を払うのは誰か

Rampのエコノミスト、Ara Kharazian氏はFortuneに対し、この力学をはっきりと述べている。

OpenAIとAnthropicは価格競争のただ中にあり、それがAIの価格を押し下げている。

そこに添えられた警告の方が、腰を据えて考える価値がある。この2社に対する強気の見立ては、モデルは高性能になるほど高価になるという前提に立っている。テクノロジー市場がそう動くことは稀だ。そして性能が数ポイントの差に収束していくなかで2社が同じ午後に値下げするというのは、製品がコモディティ化した投入財になりつつある市場の形である。

買い手にとってこれは素直に良いことであり、だからこそコストで正規化された比較表は、このリリースの正しい読み方でもある。売り手にとっては、差別化要因はもはやどのモデルが最良かではない。1タスクあたりのコストであり、その利幅は一方向にしか向かっていない。

Sources: Introducing GPT-6 Sol and Luna (OpenAI) · OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes (TechCrunch) · OpenAI releases GPT-6 Sol and Luna — and cuts token prices in half (The New Stack) · Anthropic releases Claude Opus 5.5 and OpenAI counters with two cheaper GPT-6 models (SiliconANGLE) · What slowdown? OpenAI, Anthropic release dueling models as AI price wars heat up (Fortune) · OpenAI upgrading ChatGPT and Codex with two more GPT-6 models (9to5Mac)

続けて読む