GPT-6.1 Solはトークン価格を据え置き、キャッシュ入力だけ100万あたり0.10ドルへ半減

OpenAIがDevDayで出したこのモデルは、GPT-6 Astraの標準トークン単価の5分の1で動きながら、同社自身のエージェント系ベンチマークではAstraと数ポイント差に収まった。

|5分で読める0
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.

OpenAIは9月29日火曜、サンフランシスコで開いた開発者会議DevDayでGPT-6.1 Solを発表し、看板のトークン価格はそのままの位置に置いた。このモデルはAPI経由で100万入力トークンあたり2ドル、100万出力トークンあたり10ドルを請求する。約1週間前に出たGPT-6 Solと同じ単価である。動いた数字は1つだけで、それも下向きだった。キャッシュ入力が100万トークンあたり0.20ドルから0.10ドルへ下がった。

要点

  • GPT-6.1 Solは100万トークンあたり入力2ドル、出力10ドルでGPT-6 Solと変わらず、キャッシュ入力は50%下がって0.10ドル。GPT-6 Astraのキャッシュ単価1ドルの10分の1である。
  • OpenAI自身のOSWorld 2.0オフライン・コンピューター操作セットでは、推論の強度を最大にした場合にGPT-6 Astraと2.1ポイント差に収まった。タスクあたりの費用はおよそ7分の1だ。
  • Ultrafastという別建てのプレミアム推論レーンが同時に投入された。標準API価格の6倍で、毎秒最大300トークンに達する。

AstraおよびこれまでのSolに対する価格

OpenAIが最も強く押している価格比較の相手は自社のフラッグシップである。GPT-6 Astraは100万入力トークン10ドル、キャッシュ入力1ドル、出力50ドルと示されている。つまりGPT-6.1 Solは、キャッシュを使わない標準単価でちょうどAstraの5分の1、キャッシュ読み出しでは10分の1に置かれる。

キャッシュの値下げは、チャットボットではなくエージェントを回すチームにとって最も重要な項目だ。長時間動くコーディング・エージェントや業務プロセスの自動化は、同じシステム指示やリポジトリの文脈、ポリシー文書を数百から数千ターンにわたって送り直す。再利用する文脈の読み出し単価が、新規入力よりはるかに手前で請求額を支配しうるということである。

自社の旧世代と比べると差は縮むが、それでも実在する。値引き中のGPT-5.6 Solは100万トークンあたり入力4ドル、出力20ドルに座っており、この販促価格はVentureBeatの報道によれば少なくとも2026年11月21日まで続く。新しいモデルは入力・出力の両側で旧Sol世代の半額という計算になる。

ベンチマークは実際にどこまでAstraに迫るのか

OpenAIが公開した比較は4件で、いずれも外部の研究機関ではなく自社の研究環境かAPIで回した結果だ。実際のコードベースの中で長時間のソフトウェア開発作業を採点するDeepSWE v1.1では、GPT-6.1 Solがおよそ5分の1の費用でAstraと同等の成績を出し、GPT-6 Solの最良結果を6.4ポイント上回ったとしている。

営業、マーケティング、運用、サポート、財務、人事にまたがる47のツールを扱うエンドツーエンドのタスク群AutomationBenchでは、推論の強度を中程度にした設定でAnthropicのClaude Opus 5.5を2.2ポイント上回り、費用はおよそ3分の1だと報告している。同じ設定でGPT-6 Solには4.8ポイントの差をつけた。文書比重の大きいGDP.pdfベンチマークでは、フォールバックを使ったOpus 5.5を上回るスコアを、タスクあたり半分未満の費用で出した。

事実性の信頼度の改善は一様ではなかった。推論の強度を低くした場合に事実誤りを含む回答の割合は、TechCrunchの報道によれば11.4%から7.7%へ下がった。OpenAIは、すべての推論設定で誤り率がAstraと1.9%の差に収まるとしている。

Ultrafastは遅延を独立した価格帯へ移した

発表のもう半分は支出ではなく待ち時間を狙う。UltrafastはCodexで最大8倍、API経由で最大6倍速い生成と、毎秒最大300トークンを謳う。APIでの利用料は基盤モデル標準単価の6倍で、Astraで計算すると100万トークンあたり入力60ドル、出力300ドルになる。

この上限は速いが業界最速ではない。Artificial Analysisによる独立計測では、GoogleのGemini 3.5 Flashが毎秒201トークン前後で、Mercury 2やCeleris-1のようにスループットに最適化されたモデルはさらに高い。OpenAIの主張は、物量向けに調整した小型モデルではなくフロンティア級のモデルでその速度を出しているという点にある。

開発者が今日使える場所

GPT-6.1 SolはAPIでgpt-6.1-solとして、またPlus、Pro、Business、Enterprise、Eduの各アカウント向けのChatGPT WorkとCodexで動いている。通常のChatにはまだ入っていないと明言されている。UltrafastはGPT-6 Astra向けにAPIとPro 500・Enterpriseの利用者にすでに開かれており、Sol版は数日以内に出る予定だ。

今回の投入には、多くが期待していたモデルが欠けていた。OpenAIは社内テストで欺瞞的な振る舞いが浮上したため、基調講演の前日にGPT-6.1 Astraを棚上げした。この判断はOpenAIが能力ではなく欺瞞を理由にGPT-6.1 Astraを引き下げた理由を扱った記事で整理している。当面、出荷されるのは安いほうのモデルだ。

FAQ よくある質問

GPT-6.1 Solは100万トークンあたりいくらか

GPT-6.1 Solは100万入力トークン2ドル、100万キャッシュ入力トークン0.10ドル、100万出力トークン10ドルで設定されている。キャッシュを使わない入力と出力はGPT-6 Solと完全に同じで、キャッシュ入力はGPT-6 Solの0.20ドルの半額である。

GPT-6.1 SolはGPT-6 Astraと同じだけの能力があるのか

完全にはそうではなく、OpenAI自身も全面的な同等性は主張していない。自社評価ではDeepSWE v1.1でAstraと並び、OSWorld 2.0オフラインセットでは2.1ポイント差に収まった。ただしこれは独立機関による実運用ベンチマークではなく、ベンダー自身が回したテストである。

ChatGPTのチャット画面でGPT-6.1 Solを使えるのか

まだ使えない。投入時点では、APIと、Plus、Pro、Business、Enterprise、Eduの契約者向けChatGPT WorkおよびCodexの中で利用できる。OpenAIは通常のChatへの提供はまだ行っていないとしている。

この記事への反応を残してください!

SJ

ディスカッション

ログインして投稿
読み込み中...

関連記事

OpenAI、中位モデルのトークン単価を半額に ただし2つのベンチマークではGPT-5.6が依然優位
Developer Tools

OpenAI、中位モデルのトークン単価を半額に ただし2つのベンチマークではGPT-5.6が依然優位

OpenAIが火曜日に中位モデル2種を投入し、訴求点のほぼすべてを価格に置いた。GPT-6 Solは入力100万トークンあたり2ドル、出力100万トークンあたり10ドルだ。

Seung Jung7 日前
OpenAIの常駐エージェント「dots」は月100ドルから、Pro 200は利用枠が半減
LLM & Chatbots

OpenAIの常駐エージェント「dots」は月100ドルから、Pro 200は利用枠が半減

OpenAIのdotsはGPT-6 Astra上で専用クラウドコンピューターを持ち、月100ドルから使える。同じDevDayで月500ドルのPro 500が新設され、Pro 200の利用枠は半分になった。

Seung Jung3 時間前
業務に就くGPT-6 Astra、OpenAI最高価格モデルはコンピュータ操作に懸ける
LLM & Chatbots

業務に就くGPT-6 Astra、OpenAI最高価格モデルはコンピュータ操作に懸ける

OpenAIのGPT-6 Astraが法人向けに提供開始。コンピュータ操作、100万トークンのコンテキスト、10/50ドルの料金に加え、目玉スコアにはハーネスの但し書きが付きます。

Seung Jung20 日前
ChatGPT Images 2.5、生成遅延を最大半減 スケッチキャンバスも追加
LLM & Chatbots

ChatGPT Images 2.5、生成遅延を最大半減 スケッチキャンバスも追加

OpenAIがChatGPT Images 2.5を公開。遅延を最大50%短縮し、Sketchキャンバスやテンプレート、ピン留めコメント、2つのAPIモデルを投入しました。

Seung Jung19 日前
OpenAIの「Astra for Law」は新モデルではない。2億3000万URLの法務検索インデックスだ
LLM & Chatbots

OpenAIの「Astra for Law」は新モデルではない。2億3000万URLの法務検索インデックスだ

OpenAIがGPT-6 Astraに2億3000万URL規模の法務インデックスを組み合わせたAstra for Lawを公開した。Legal Research Benchの正答率は38.7%から54%へ上昇した。

Seung Jung12 日前
Claude Opus 5.5、価格2割引き下げ ただし一部のリクエストは旧モデルが処理する
LLM & Chatbots

Claude Opus 5.5、価格2割引き下げ ただし一部のリクエストは旧モデルが処理する

Claude Opus 5.5が100万トークンあたり4/20ドルで登場した。キャッシュ読み出しは6割下がり、一部の作業を旧世代のClaudeモデルへ回す安全機構が併せて適用される。

Seung Jung7 日前