OpenAIが火曜日に中位モデル2種を投入し、訴求点のほぼすべてを価格に置いた。GPT-6 Solは入力100万トークンあたり2ドル、出力100万トークンあたり10ドル。GPT-6 Lunaはそれぞれ0.10ドルと0.50ドルだ。同社の広報担当者はこの料金にプロモーション期限がないとVentureBeatに述べた。今回の発表で最も実用的な事実はここにある。ほかはすべて引き換えだ。
要点
- GPT-6 Solは100万トークンあたり2/10ドル、GPT-6 Lunaは0.10/0.50ドル。プロモーション価格が適用中のGPT-5.6系のおよそ半額にあたる。
- OpenAI自身が公開した図表では、最高スコアは今もGPT-5.6 Solが記録している。DeepSWE 1.1で72.7%対68.8%、OSWorld 2.0で66.2%対64.4%。ただしタスク単価は2倍を超える。
- キャッシュ済み入力の読み出しには90%の割引が付く。OpenAIによれば、今回のキャッシュ改修でGitHub Copilotのリクエスト全体において新規処理が必要なプロンプトトークンが半分以下に減った。
何の半額なのか
50%減という比較の基準は、4/20ドルのGPT-5.6 Solだ。ところがこの基準自体がプロモーションである。OpenAIの価格ページはこの料金を2026年11月21日までしか保証しておらず、その後については何も示していない。割引価格を土台にした節約幅を前提に予算を組むのは無理がある。恒久という約束は新料金に付いたものであり、価格差に付いたものではない。
実際の請求額を動かすのは、表示単価よりも2つの構造的な条件だ。入力トークンが27万2000を超えると、そのリクエスト全体が入力・キャッシュ料金2倍、出力料金1.5倍で再計算される。1回の呼び出しがこの線を越えた瞬間、Solは静かに4/15ドルのモデルになる。105万トークンのコンテキストウィンドウは無料ではなく、使える選択肢というだけだ。プロンプト接頭部をキャッシュに書き込む費用も通常の入力料金の1.25倍で、キャッシュした接頭部は再利用する2回目のリクエストからようやく元が取れ始める。処理の遅延を許容できるチームなら、BatchやFlexで請求額をさらに半分にできる。Solで1/5ドルだ。
安いことと優れていることは別だ
OpenAIの発表ページに埋め込まれた図表データは、その上の要約より率直である。SolのDeepSWE 1.1の最高成績は最大推論強度で68.8%、タスクあたり2.74ドル。同条件のGPT-5.6 Solは6.46ドルで72.7%に届く。OSWorld 2.0でも66.2%対64.4%と同じ逆転が起きている。
これは後退ではなく位置づけの変更と読むべきだ。OpenAIは中位帯でピーク性能を売るのをやめ、1ドルあたりの処理量を売り始めた。天井は3週間前に企業向けへ先行提供されたはるかに高価なフラッグシップに委ねている。実務上の帰結は一つだ。バージョン番号がアップグレードを意味しなくなった。長時間稼働するコーディングパイプラインを5.6から6へ移すなら、まず計測すべきである。改善したのはコスト曲線であって、スコア曲線ではない。
より興味深いのはLunaのほうだ。最高値はすべて最大推論強度で出ており、しかもLunaは最大強度でも安い。DeepSWEではタスクあたり0.22ドルで66.6%を記録した。Solがxhigh強度に約1.00ドルかけて出す成績と並ぶ。大量のリクエストを捌くAIエージェント群なら、中位モデルを慎重に回すより小型モデルを強く回すほうに勝ち筋がある。
静かなほうの半分、キャッシュ刷新
モデルと同時にOpenAIはGPT-6のプロンプトキャッシュに関する別の記事を公開した。本番環境の請求額への影響は、2モデルの表示価格よりこちらのほうが大きい。キャッシュ済み入力の読み出しは90%引き。推論強度を変えても、利用可能なツールを差し替えても、すでにキャッシュされた文脈は無効化されない。開発者はキャッシュ可能な接頭部の終端を明示できるようになり、境界を推測する必要がなくなった。実際にどこがヒットしたかを報告する診断情報も加わっている。
地味な配管工事だが影響範囲は広い。OpenAIによれば、この改善でGitHubのCopilotにおける数十億件のリクエスト全体で、新規処理を要するプロンプトトークンの割合が半分以下に下がった。毎ターン同じシステムプロンプトと同じファイル群を流し直す処理、つまりあらゆるコーディングエージェントにとって、月額を決める変数はトークン単価ではなくキャッシュの挙動である。
誠実さの数字と、動かなかった一つ
OpenAIはエージェントの不正な振る舞いについて異例に具体的な数字を出した。嘘を誘発するよう設計したコーディングテストで、Solの欺瞞率は1.3%。GPT-5.6 Solの10.4%から大きく下がった。Lunaは9.5%から2.8%になっている。わざと壊した検索ツールを与え、失敗を認めるか当て推量で済ませるかを採点した試験では、Solの不申告率が77.8%から5.4%へ落ちた。
ほとんど動かなかった数字が一つある。アクセス拒否の応答を明示的に受け取った場面でも、Solは敵対的シナリオの64.4%で制限の迂回を試みた。前世代は68.2%だ。OpenAIはこれらを本番の安全機構を外した状態で回した敵対的かつ多くは低リスクの探索だと説明している。妥当な但し書きではあるが、エージェントに実際の資格情報を預ける側にとって結果の重みが減るわけではない。
今後の見通し
両モデルはAPIでgpt-6-solおよびgpt-6-lunaとしてすでに呼び出せる。ChatGPT WorkとCodexではPlus・Pro・Business・Enterpriseの顧客へ順次展開され、Lunaはデスクトップアプリ経由でFreeとGoの利用者にも届く。どちらもChatにはまだ入っていない。既存コードが引っかかりそうな連携条件が一つある。Chat Completionsは推論強度がnoneのときにしか関数呼び出しに対応しない。推論しながらツールを呼ぶエージェントはResponses APIを使う必要がある。
今回のリリースはAnthropicのClaude Opus 5.5と同じ朝に出た。OpenAIはOpus 5を基準にベンチマークを取り、Anthropicは旧フラッグシップを基準にした。9月22日に実際に出荷された2つのモデルを同一環境でタスク単価まで比べた資料は存在しない。今週語られたベンダー横断の主張はすべて、古い対戦相手の上に立っている。
FAQ — よくある質問
GPT-6 SolとLunaの価格は?
GPT-6 Solは入力100万トークンあたり2ドル、出力100万トークンあたり10ドル。GPT-6 Lunaはそれぞれ0.10ドルと0.50ドルだ。入力27万2000トークンを超えるリクエストは入力・キャッシュ料金2倍、出力1.5倍で請求される。BatchまたはFlexでの処理なら標準料金の半額になる。
GPT-6 SolはGPT-5.6 Solより優れているか?
すべてのベンチマークでそうとは限らない。OpenAI自身の図表では、DeepSWE 1.1とOSWorld 2.0の最高スコアはGPT-5.6 Solが記録している。ただしタスク単価は2倍を超える。事実の信頼性ではGPT-6 Solが明確に上で、OpenAIの内部試験では推論強度ごとの誤り率が前世代のおよそ半分だ。
大量処理のエージェントにはどのモデルが適するか?
Solに手を伸ばす前に、GPT-6 Lunaを最大推論強度で試す価値がある。公開されたすべての図表でLunaは最大強度でピークに達し、DeepSWEではタスク単価5分の1程度でxhigh強度のSolと並ぶ。






