GPT-6.1 Sol, 토큰 가격 그대로 두고 캐시 입력만 100만당 0.10달러로 반값

OpenAI가 DevDay에서 내놓은 이 모델은 GPT-6 Astra 표준 토큰 단가의 5분의 1로 돌아가면서, 자사 에이전트 벤치마크에서는 Astra와 몇 점 차이 안에 들어왔다.

|5분 읽기0
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.

OpenAI가 9월 29일 화요일 샌프란시스코에서 열린 DevDay 개발자 콘퍼런스에서 GPT-6.1 Sol을 공개하면서, 간판 토큰 가격은 있던 자리에 그대로 뒀다. 이 모델은 API에서 100만 입력 토큰당 2달러, 100만 출력 토큰당 10달러를 청구한다. 약 일주일 앞서 나온 GPT-6 Sol과 같은 단가다. 움직인 숫자는 하나뿐이고, 그것도 아래로 갔다. 캐시 입력이 100만 토큰당 0.20달러에서 0.10달러로 내려갔다.

핵심 요약

  • GPT-6.1 Sol은 100만 토큰당 입력 2달러, 출력 10달러로 GPT-6 Sol과 같고, 캐시 입력은 50% 내려 0.10달러다. GPT-6 Astra의 캐시 단가 1달러의 10분의 1이다.
  • OpenAI 자체 OSWorld 2.0 오프라인 컴퓨터 조작 세트에서, 이 모델은 추론 강도를 최대로 올렸을 때 GPT-6 Astra와 2.1퍼센트포인트 차이 안에 들어왔다. 작업당 비용은 약 7분의 1이다.
  • Ultrafast라는 별도의 프리미엄 추론 경로가 함께 출시됐다. 표준 API 가격의 6배에 초당 최대 300토큰에 이른다.

Astra와 이전 Sol 대비 GPT-6.1 Sol의 가격

OpenAI가 가장 강하게 밀고 있는 가격 비교 대상은 자사 플래그십이다. GPT-6 Astra는 100만 입력 토큰 10달러, 캐시 입력 1달러, 출력 50달러로 책정돼 있다. GPT-6.1 Sol은 캐시를 쓰지 않는 표준 단가에서 정확히 Astra의 5분의 1, 캐시 읽기에서는 10분의 1에 놓인다.

캐싱 인하는 챗봇이 아니라 에이전트를 돌리는 팀에게 가장 중요한 항목이다. 장시간 돌아가는 코딩 에이전트와 업무 프로세스 자동화는 같은 시스템 지시문, 리포지터리 맥락, 정책 문서를 수백에서 수천 턴에 걸쳐 다시 보낸다. 재사용 맥락의 읽기 단가가 새 입력보다 훨씬 앞서 청구서를 지배할 수 있다는 뜻이다.

OpenAI 자체 구세대와 비교하면 격차는 좁아지지만 여전히 실재한다. 할인 중인 GPT-5.6 Sol은 100만 토큰당 입력 4달러, 출력 20달러에 앉아 있고, 이 프로모션 가격은 VentureBeat 보도에 따르면 최소 2026년 11월 21일까지 유지된다. 새 모델이 입력과 출력 양쪽에서 이전 Sol 세대의 절반 가격이라는 계산이 나온다.

벤치마크가 Astra에 실제로 얼마나 붙었나

OpenAI가 내놓은 비교는 네 건이며, 모두 외부 기관이 아니라 자사 연구 환경이나 API에서 돌린 결과다. 실제 코드베이스 안에서 장시간 소프트웨어 엔지니어링 작업을 채점하는 DeepSWE v1.1에서, 회사는 GPT-6.1 Sol이 약 5분의 1 비용으로 Astra와 같은 성적을 냈고 GPT-6 Sol의 최고 기록을 6.4퍼센트포인트 넘어섰다고 밝혔다.

영업·마케팅·운영·지원·재무·인사에 걸쳐 47개 도구를 다루는 종단 작업 모음 AutomationBench에서는, 추론 강도 중간 설정에서 Anthropic Claude Opus 5.5를 2.2포인트 앞섰고 비용은 약 3분의 1이라고 보고했다. 같은 설정에서 GPT-6 Sol보다는 4.8포인트 높았다. 문서 비중이 큰 GDP.pdf 벤치마크에서는 폴백을 쓴 Opus 5.5보다 높은 점수를 작업당 절반 미만 비용으로 기록했다.

사실 신뢰도 개선은 고르지 않았다. 추론 강도를 낮게 뒀을 때 사실 오류가 포함된 응답 비율은 TechCrunch 보도에 따르면 11.4%에서 7.7%로 내려갔다. OpenAI는 모든 추론 설정에서 오류율이 Astra와 1.9% 차이 안에 머문다고 밝혔다.

Ultrafast는 지연 시간을 별도 가격 등급으로 옮겼다

발표의 나머지 절반은 지출이 아니라 기다림을 겨냥한다. Ultrafast는 Codex에서 최대 8배, API에서 최대 6배 빠른 생성과 초당 최대 300토큰을 약속한다. API 접근 비용은 기본 모델 표준 단가의 6배이며, Astra 기준으로 계산하면 100만 토큰당 입력 60달러, 출력 300달러가 된다.

이 상한은 빠르지만 업계 최고는 아니다. Artificial Analysis의 독립 측정에서 Google Gemini 3.5 Flash는 초당 201토큰 수준이고, Mercury 2나 Celeris-1처럼 처리량에 최적화된 모델은 훨씬 높다. OpenAI의 논리는 물량용으로 다듬은 작은 모델이 아니라 프런티어급 모델에서 그 속도를 제공한다는 것이다.

개발자가 지금 쓸 수 있는 곳

GPT-6.1 Sol은 API에서 gpt-6.1-sol로, 그리고 Plus·Pro·Business·Enterprise·Edu 계정의 ChatGPT Work와 Codex에서 쓸 수 있다. 일반 Chat에는 아직 들어가지 않았다고 명시했다. Ultrafast는 GPT-6 Astra용으로 API와 Pro 500·Enterprise 사용자에게 이미 열려 있으며, Sol 버전은 며칠 안에 나온다.

이번 출시에는 많은 사람이 기대했던 모델이 빠졌다. OpenAI는 내부 테스트에서 속임 행동이 드러난 뒤 기조연설 하루 전 GPT-6.1 Astra를 보류했고, 이 결정은 OpenAI가 성능이 아니라 속임을 이유로 GPT-6.1 Astra를 내린 이유를 다룬 기사에서 정리했다. 당장 배포되는 쪽은 더 싼 모델이다.

FAQ 자주 묻는 질문

GPT-6.1 Sol은 100만 토큰당 얼마인가

GPT-6.1 Sol은 100만 입력 토큰 2달러, 100만 캐시 입력 토큰 0.10달러, 100만 출력 토큰 10달러로 책정됐다. 캐시를 쓰지 않는 입력과 출력은 GPT-6 Sol과 정확히 같고, 캐시 입력은 GPT-6 Sol의 0.20달러 단가의 절반이다.

GPT-6.1 Sol은 GPT-6 Astra만큼 뛰어난가

완전히 그렇지는 않고, OpenAI도 전 영역 동급이라고 주장하지 않는다. 자사 평가에서 이 모델은 DeepSWE v1.1에서 Astra와 같은 성적을 냈고 OSWorld 2.0 오프라인 세트에서 2.1퍼센트포인트 차이 안에 들어왔다. 다만 이는 독립 기관의 운영 환경 벤치마크가 아니라 벤더가 직접 돌린 테스트다.

ChatGPT 채팅 화면에서 GPT-6.1 Sol을 쓸 수 있나

아직 안 된다. 출시 시점에 이 모델은 API와, Plus·Pro·Business·Enterprise·Edu 구독자용 ChatGPT Work 및 Codex 안에서 쓸 수 있다. OpenAI는 일반 Chat 접근은 아직 배포하지 않았다고 밝혔다.

이 기사에 대한 반응을 남겨주세요!

SJ
로딩 중...

관련 기사

OpenAI, 중급 모델 토큰 가격 반토막…벤치마크 두 곳은 여전히 GPT-5.6이 앞선다
Developer Tools

OpenAI, 중급 모델 토큰 가격 반토막…벤치마크 두 곳은 여전히 GPT-5.6이 앞선다

OpenAI가 화요일 중급 모델 두 종을 내놓으면서 설득 논리를 거의 전부 가격에 걸었다. GPT-6 Sol은 100만 입력 토큰당 2달러, 출력 100만 토큰당 10달러다.

Seung Jung7일 전
OpenAI 상시 에이전트 '닷', 월 100달러부터 — Pro 200은 사용량 절반 잃었다
LLM & Chatbots

OpenAI 상시 에이전트 '닷', 월 100달러부터 — Pro 200은 사용량 절반 잃었다

OpenAI의 닷은 GPT-6 Astra 위에서 전용 클라우드 컴퓨터를 갖고 작동하며 월 100달러부터 쓸 수 있다. 같은 DevDay에서 월 500달러 Pro 500이 신설되고 Pro 200 사용량은 반토막 났다.

Seung Jung3시간 전
업무에 투입된 GPT-6 Astra, OpenAI 최고가 모델이 컴퓨터 사용에 모든 것을 걸었다
LLM & Chatbots

업무에 투입된 GPT-6 Astra, OpenAI 최고가 모델이 컴퓨터 사용에 모든 것을 걸었다

OpenAI의 GPT-6 Astra가 컴퓨터 사용 기능과 100만 토큰 컨텍스트, 10/50달러 가격으로 기업 사용자에게 풀린다. 대표 점수에는 하네스 단서가 붙는다.

Seung Jung20일 전
ChatGPT Images 2.5, 생성 속도 두 배로… 스케치 캔버스도 붙였다
LLM & Chatbots

ChatGPT Images 2.5, 생성 속도 두 배로… 스케치 캔버스도 붙였다

OpenAI가 ChatGPT Images 2.5를 내놨다. 지연 시간을 최대 50% 줄이고 Sketch 캔버스와 템플릿, 고정 댓글, API 모델 두 종을 함께 공개했다.

Seung Jung19일 전
OpenAI의 Astra for Law는 새 모델이 아니다, 2억 3000만 URL 법률 색인이다
LLM & Chatbots

OpenAI의 Astra for Law는 새 모델이 아니다, 2억 3000만 URL 법률 색인이다

OpenAI가 GPT-6 Astra에 2억 3000만 URL 규모 법률 색인을 결합한 Astra for Law를 공개했다. 리걸 리서치 벤치 정확도는 38.7%에서 54%로 올랐다.

Seung Jung12일 전
Claude Opus 5.5, 20% 싸졌다…단 일부 요청은 구형 모델이 대신 처리한다
LLM & Chatbots

Claude Opus 5.5, 20% 싸졌다…단 일부 요청은 구형 모델이 대신 처리한다

Claude Opus 5.5가 100만 토큰당 4/20달러에 나왔다. 캐시 읽기는 60% 내렸고, 일부 작업을 구형 Claude 모델로 넘기는 안전장치가 함께 적용된다.

Seung Jung7일 전