人工知能
Anthropic、HaikuをGPT-6 Lunaと同額まで値下げ。両者が分かれるのは10万トークンの細則だ
Claude Haiku 5.5の入力価格は100万トークンあたり0.10ドル。前世代の10分の1で、OpenAIのGPT-6 Lunaと同額だ。新たな二段階料金と、ベンチマーク表から外された各社が、この見出しを単純ではなくしている。
MAI
Anthropicは水曜日にClaude Haiku 5.5を公開した。注目すべき数字はベンチマークではない。このモデルの基本料金は入力100万トークンあたり0.10ドル、出力0.50ドル。Haiku 4.5の10分の1であり、OpenAIがGPT-6 Lunaに課す料金とセント単位まで一致する。ほかのほぼすべてで競合する二つの研究所が、小型モデルの下限価格について同じ地点に着地した。
価格
| 100万トークンあたり | Haiku 5.5(10万以下) | Haiku 5.5(10万超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 入力 | $0.10 | $0.50 | $1.00 | $2.00 |
| 出力 | $0.50 | $2.50 | $5.00 | $10.00 |
| キャッシュ読み取り | $0.01 | $0.05 | $0.10 | $0.10 |
| キャッシュ書き込み | $0.125 | $0.625 | $1.25 | $2.50 |
見出しは90%の値下げだ。より正直な数字はAnthropic自身が出している——平均的なワークロードでおよそ75%のコスト減である。同じ発表でSonnet 5.5のキャッシュ読み取り価格も0.10ドルへ半減し、Anthropicは典型的なエージェント処理で約20%の節約になると見積もる。MaxおよびTeamの契約者には今週から月次のAPIクレジットが提供される——100ドル、200ドル、そしてチーム全体で最大500ドルの共有枠だ。
Haikuに段差ができた
Haiku 4.5はリクエストの大きさに関係なく単一料金だった。Haiku 5.5は入力10万トークンを超えると5倍を課す。AnthropicによればHaiku 4.5のリクエストの約90%がこの閾値を下回っていた。それが75%という平均値の根拠であり、同時に残り1割の既存トラフィックの割引幅がはるかに小さくなることも意味する。1タスクあたりのトークン消費がやや増える新しいトークナイザーも、同じ見積もりに織り込まれている。
GPT-6 Lunaとの一致が一致でなくなるのはここだ。Lunaの上位料金は入力27万2000トークンから始まるが、Haikuは10万から始まる。両モデルが共有しているのは表示価格であって、コスト曲線ではない。そして差を最も感じるのは、まさに安価なモデルが充てられる種類の処理——長文書の要約、大規模コンテキストの検索、履歴を積み上げていくエージェントのループである。見出しの数字で移行コストを見積もるチームは、誤った答えを得ることになる。
比較対象はOpenAIで止まっている
Anthropicの評価表は、Haiku 5.5をHaiku 4.5、GPT-6 Luna、Sonnet 5.5と並べるだけで、それ以外はない。以下はいずれも同社自身が公表した結果であり、第三者による再現はされていない。
| 評価 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1,620 | 735 | 1,437 | 1,840 |
| OSWorld 2.1(オフライン部分) | 72.4% | 15.7% | 48.9% | 83.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 | 46.4% | — | 42.4% | 52.1% |
| Humanity's Last Exam(ツールなし) | 45.9% | 10.2% | — | 56.9% |
世代間の伸びはそれ自体として十分興味深い——Haiku 4.5はTerminal-Bench 4.0で0点だったのに対し、新モデルは39%を超えた。ただしその39.2%は最大エフォートでの結果である。既定の中エフォートでは、Anthropic自身の数字で約20%にとどまる。見出しのエージェント性能は、多くの開発者が実際に動かす設定ではない。
表から抜け落ちているのは中国の各社だ。The New Stackは、Z.aiのGLM-5.3-FlashがGDPval-AA v2.1で1,647を記録し、Haiku 5.5の1,620を上回ること、そしてAlibabaのQwen3.7 Flashがトークンあたりでより安価であることを指摘している。どちらもAnthropicの比較には現れない。フロンティア研究所が自ら参照点を選ぶ権利はあるが、「最も安く最も高性能」という枠組みで打ち出された小型モデルの発表は、その表が示唆するほど強くは両方を主張できない。
実際の用途
Anthropicは、大型モデルが仕事をする間にHaiku 5.5が分類やルーティングを担う、という売り込みはしていない。Opus 5.5やSonnet 5.5と並走するサブエージェント——コンテキストの圧縮、データベース照会、ブラウザ操作、ライブサポート——として打ち出している。Haikuクラスで初めてエフォート調整機能を備え、PythonとTypeScriptのSDKにはコンピュータ操作とブラウザ操作のベータ対応が加わった。BoxはHaiku 4.5より11ポイント高いスコアを、レイテンシほぼ半分で得たと報告し、HubSpotは自社CRM評価の3回平均で92.8%を報告している。
セーフガードは価格と逆方向に動いた。サイバーセキュリティ関連の制限はHaiku 4.5より厳しく、標準構成ではペネトレーションテストが遮断される。より広い利用はAnthropicの検証プログラム経由となる。大量自動化を明確に狙ったモデルとしては、これは意図的な取引だ——ラインアップで最も安いモデルが、攻撃的セキュリティ作業に最も裁量の少ないモデルでもある。
読み筋
90%の値下げは、価格の話を装った性能の話ではない。価格の話そのものである。小型モデルは今、エージェント事業の勝敗が決まる層だ——1タスクで数千回呼び出されるのはこの層である——そして主要研究所の二つが、その層の価値を100万トークンあたり0.10ドルと独立に判断した。利益は意図的に手放されている。Anthropicがそれで買おうとしているのは、あらゆるOpusとSonnetの導入環境の内側にあるサブエージェントの座であり、10万トークンの細則は、その一部を取り戻そうとする場所だ。
Sources: Anthropic — Introducing Claude Haiku 5.5 · VentureBeat · The New Stack