Claude Opus 5.5、価格2割引き下げ ただし一部のリクエストは旧モデルが処理する

表示価格よりキャッシュ読み出しの値下げが効く。そして脚注一つが、自分のリクエストがいつOpus 5.5の回答でなくなるかを教えている

|5分で読める0
Server racks of the kind that serve frontier model inference, where cache-read pricing decides the cost of long-running Claude Opus 5.5 agent sessions.
Server racks of the kind that serve frontier model inference, where cache-read pricing decides the cost of long-running Claude Opus 5.5 agent sessions.

AnthropicのClaude Opus 5.5公開で最も重い数字は、多くの報道が見出しに掲げたものではない。入力・出力トークンが2割下がって100万あたり4ドルと20ドルになったのは事実だ。だがキャッシュ読み出しは6割下がり、100万あたり0.20ドルになった。このモデルが狙う長時間のエージェントセッションでは、請求額を決めるのはこの項目である。

要点

  • Claude Opus 5.5の価格は入力100万トークンあたり4ドル、出力100万トークンあたり20ドル。キャッシュ読み出しは100万あたり0.20ドルで、Opus 5より6割安い。
  • Anthropicは本番用の安全機構を組み込んで配備する。作動するとサイバーセキュリティ作業はClaude Opus 4.8が、生物学とフロンティアモデル開発の作業はClaude Opus 5が処理する。
  • Opus 5.5はTerminal-Bench 4.0で66.4%、GDPval-AA v2.1で1846 Eloを記録し、Claude Fable 5.1とOpenAIのGPT-6 Astraをいずれも上回った。

エージェントの採算をキャッシュ価格が決める理由

夜通しコードベースを扱うAIエージェントは、毎ターン新しい文脈を送るわけではない。同じシステムプロンプト、同じツール定義、同じファイルを何度も送り直す。この再送される接頭部がキャッシュ読み出しであり、秒ではなく時間単位で続くセッションではこれがメーターを支配する。

Anthropic自身も、キャッシュ読み出しがエージェント作業とコーディング作業の費用の大半を占めると説明しており、同じ認識を示している。ならばここでの6割引きは、新規入力の2割引きよりも夜間マイグレーションにはるかに効く。Opus 5の予算を出力トークンだけで組んできたチームは、見るべき変数を取り違えていたことになる。

スループットも同じ方向へ動いた。出力生成はOpus 5より3割以上速い。Claude CodeとClaude Platformにある別建てのFastモードは100万トークンあたり8ドルと40ドルで価格と待ち時間を交換し、最大2.5倍の速度をうたう。Pro・Max・Teamおよび席数課金のEnterpriseプランでは5時間あたりの利用上限が引き上げられ、契約者はレート制限のリセット分を貯めておき、締め切りが迫ったときに使えるようになった。

リクエストがOpus 5.5でなくなるとき

購入を検討するなら、脚注を一つだけ二度読むべきだ。Opus 5.5は生物学とサイバーセキュリティの能力でClaude Mythos 5.1に迫るため、AnthropicはFable 5.1向けに作った安全機構を被せて出荷している。機構が作動してもリクエストは失敗しない。別のモデルが代わりに完了させる。

サイバーセキュリティの作業はClaude Opus 4.8が、生物学とフロンティアLLM開発の作業はClaude Opus 5が完了した。

隠さず開示している点は評価でき、安全設計としても擁護できる。同時に、フロンティア級の料金を払って使う製品の内側で能力が静かに入れ替わるということでもある。API上にセキュリティ製品を作る側は、トラフィックの一部が2世代前のモデルの回答で返ってくると想定しておくべきだ。実務上の問いは、この振り替えが正当かどうかではない。応答が他と見分けのつかない姿で届く以上、自分の評価基盤が作動のタイミングを検知できるかどうかである。

この仕組みはスコアボードも歪める。Zapierは代替モデルを設定しないままAutomationBenchを回したため、安全機構の介入がすべて失敗として集計された。Opus 5.5が40.0%にとどまり、GPT-6 Astraの41.4%に及ばなかった背景がこれだ。Anthropicは本番配備ならその分は失われないと主張する。OpenAIの対抗図表は同じ仕掛けを反対側から見せている。Opus 5を代替に設定したFable 5.1構成は31.4%に達したが、OpenAIはその費用の数字が全体の約4割のタスクで作動した代替処理を除いたものだと認めている。

テスターが実際に測ったもの

Anthropicが公開した根拠の多くは、賢さではなく処理量に関するものだ。あるテスターは68万行のコード移行を1日で終えた。別のテスターは20万行のコードベースを3時間以内で監査し修復した。Opus 5は同じ作業に20時間超と2.5倍のトークンを要している。HAProxyをCからRustへ移す社内作業は、Fable 5.1の12時間に対し9.5時間で完了し、費用は51%低かった。

いずれも知能の主張ではない。すべてスループットの主張であり、モデル更新を予算の一行に変えるのはこのスループットだ。顧客側の数字も同じ型を繰り返す。手数は減り、出力は短くなり、結果は同等かそれ以上になる。Deloitteは最低の推論強度で回した本モデルがコードレビューで既知バグの72%を検出したと報告した。同じ試験で高強度のOpus 5は56%だった。Hebbiaは専門家採点の金融ワークフローで86.6%のカバー率を付け、Opus 5は60.3%だった。公開ベンチマークでは、Opus 5.5がTerminal-Bench 4.0で66.4%、GDPval-AA v2.1で1846 Eloを記録し、同指標でFable 5.1は1735、GPT-6 Astraは1542である。

CEO自身が速すぎると述べた刊行ペース

居心地が悪いのはカレンダーだ。The Registerの集計では、Fable 5.1とOpus 5.5の間は21日、Opus 5とFable 5.1の間は39日。ダリオ・アモデイCEOが能力向上の減速を公に呼びかけたのは、今回の公開の10日前だった。AnthropicはOpenAIがGPT-6 SolとLunaを出したのと同じ朝に投入しており、GPT-6 Astraが企業顧客に届いてから3週間後にあたる。詳細はAnthropicの公式発表にある。Sonnet 5.5とHaiku 5.5は数週間内に続く予定で、キャッシュ読み出しの値下げが最も多くのワークロードに効いてくるのはそのときだ。

FAQ — よくある質問

Claude Opus 5.5の価格は?

Opus 5.5は入力100万トークンあたり4ドル、出力100万トークンあたり20ドルで、Opus 5より2割安い。キャッシュ読み出しは100万あたり0.20ドルで6割の引き下げ。Claude CodeとClaude Platformの別建てFastモードは100万トークンあたり8ドルと40ドルで、最大2.5倍の速度が得られる。

AnthropicはOpus 5.5のリクエストを旧モデルへ回すことがあるか?

限られた場面ではある。AnthropicはOpus 5.5の本番用安全機構が介入した場合、サイバーセキュリティ作業はClaude Opus 4.8が、生物学とフロンティアモデル開発の作業はClaude Opus 5が完了すると説明している。審査を通った組織はAnthropicのLife Sciences Verification Programに申請でき、Cyber Verification Programも数週間内に拡大する。

Opus 5.5はGPT-6 Astraより優れているか?

タスク次第だ。Opus 5.5はTerminal-Bench 4.0(66.4%対57.9%)とGDPval-AA v2.1(1846 Elo対1542)で先行し、AstraはAutomationBench(41.4%対40.0%)とTerminal-Bench-Science 0.1(64.6%対58.7%)で先行する。両社は異なる評価基盤と推論強度で測っており、差を直接比べることはできない。

この記事への反応を残してください!

SJ

ディスカッション

ログインして投稿
読み込み中...

関連記事

OpenAI、中位モデルのトークン単価を半額に ただし2つのベンチマークではGPT-5.6が依然優位
Developer Tools

OpenAI、中位モデルのトークン単価を半額に ただし2つのベンチマークではGPT-5.6が依然優位

OpenAIが火曜日に中位モデル2種を投入し、訴求点のほぼすべてを価格に置いた。GPT-6 Solは入力100万トークンあたり2ドル、出力100万トークンあたり10ドルだ。

Seung Jung8 時間前
業務に就くGPT-6 Astra、OpenAI最高価格モデルはコンピュータ操作に懸ける
LLM & Chatbots

業務に就くGPT-6 Astra、OpenAI最高価格モデルはコンピュータ操作に懸ける

OpenAIのGPT-6 Astraが法人向けに提供開始。コンピュータ操作、100万トークンのコンテキスト、10/50ドルの料金に加え、目玉スコアにはハーネスの但し書きが付きます。

Seung Jung13 日前
Metaの「Muse」、あなたの受信箱とカレンダーとクレジットカードを狙う
LLM & Chatbots

Metaの「Muse」、あなたの受信箱とカレンダーとクレジットカードを狙う

Metaがパーソナルエージェント「Muse」を公開。米国のiOS、Android、ウェブ、WhatsAppで旅行予約や請求の支払い、買い物を代行する。

Seung Jung12 日前
Anthropic、インフォスティーラーが有料Claudeアカウントの利用枠を食い潰していると警告
LLM & Chatbots

Anthropic、インフォスティーラーが有料Claudeアカウントの利用枠を食い潰していると警告

Anthropicが、インフォスティーラーにログインセッションを盗まれたClaude利用者へ警告メールを送っている。攻撃者はパスワードを見ずに有料の利用枠を消費している。

Seung Jung13 日前
Claudeは成人限定、しかし年齢判定が成人まで締め出している
LLM & Chatbots

Claudeは成人限定、しかし年齢判定が成人まで締め出している

AnthropicがClaudeの18歳以上ルールの運用を公開した。分類器が未成年と疑われるアカウントを停止し、誤判定された成人はYotiの確認で復旧できる。

Seung Jung12 日前
OpenAI、Dataエージェントとウォール街版ChatGPTを同じ日に投入
LLM & Chatbots

OpenAI、Dataエージェントとウォール街版ChatGPTを同じ日に投入

OpenAIが同じ木曜日に、ChatGPT Work向けDataエージェントと、Morgan Stanley・Evercoreと共同開発したChatGPT for Financial Servicesを公開した。

Seung Jung13 日前