GPT-6.1 Sol mantiene el precio de Sol y reduce a la mitad la entrada en caché, a 0,10 dólares por millón

El modelo que OpenAI presentó en DevDay cuesta una quinta parte de las tarifas estándar de tokens de GPT-6 Astra y queda a pocos puntos de él en los propios benchmarks de agentes de la empresa.

|5 min de lectura0
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.
Server racks of the kind that run inference for models like OpenAI's GPT-6.1 Sol, whose cached-input price drop targets long-running agent workloads.

OpenAI presentó GPT-6.1 Sol en su conferencia para desarrolladores DevDay, celebrada en San Francisco el martes 29 de septiembre, y dejó el precio principal por token exactamente donde estaba. El modelo cobra 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida a través de la API, las mismas tarifas que el lanzamiento de GPT-6 Sol al que sigue por cerca de una semana. La única cifra que se movió lo hizo hacia abajo: la entrada en caché bajó de 0,20 a 0,10 dólares por millón de tokens.

Claves

  • GPT-6.1 Sol cuesta 2 dólares de entrada y 10 de salida por millón de tokens, sin cambios frente a GPT-6 Sol, mientras la entrada en caché cae un 50% hasta 0,10 dólares: una décima parte de la tarifa en caché de 1 dólar de GPT-6 Astra.
  • En el conjunto de uso de computadora sin conexión OSWorld 2.0, elaborado por OpenAI, el modelo termina a 2,1 puntos porcentuales de GPT-6 Astra con el máximo esfuerzo de razonamiento y a cerca de una séptima parte del costo por tarea.
  • Junto con él se lanzó un carril premium de inferencia llamado Ultrafast, que alcanza hasta 300 tokens por segundo por seis veces el precio estándar de la API.

Cuánto cuesta GPT-6.1 Sol frente a Astra y a los Sol anteriores

La comparación de precios que OpenAI empuja con más fuerza es contra su propio modelo estrella. GPT-6 Astra figura en 10 dólares por millón de tokens de entrada, 1 dólar de entrada en caché y 50 dólares de salida, lo que sitúa a GPT-6.1 Sol en exactamente una quinta parte de las tarifas estándar sin caché de Astra y una décima parte en las lecturas en caché.

El recorte en el almacenamiento en caché es el detalle que más importa a los equipos que operan agentes en lugar de chatbots. Los agentes de programación de larga duración y las automatizaciones de procesos de negocio reenvían las mismas instrucciones de sistema, el mismo contexto de repositorio y los mismos documentos de política a lo largo de cientos o miles de turnos, de modo que el precio de lectura del contexto reutilizable puede dominar la factura mucho antes que la entrada nueva.

Frente al propio catálogo previo de OpenAI la brecha es más estrecha, pero real. El GPT-5.6 Sol con descuento se ubica en 4 dólares de entrada y 20 de salida por millón de tokens, un precio promocional que según VentureBeat rige al menos hasta el 21 de noviembre de 2026. Eso deja al modelo más nuevo a mitad de precio que la generación Sol anterior en ambos lados del libro.

Qué tan cerca quedan realmente los benchmarks de Astra

OpenAI publicó cuatro comparaciones, todas ejecutadas en su propio entorno de investigación o su API y no por un laboratorio externo. En DeepSWE v1.1, que puntúa trabajo de ingeniería de software de larga duración dentro de bases de código reales, la empresa afirma que GPT-6.1 Sol iguala a Astra a cerca de una quinta parte del costo y supera el mejor resultado de GPT-6 Sol por 6,4 puntos porcentuales.

En AutomationBench, un conjunto de tareas de extremo a extremo que abarca 47 herramientas de ventas, marketing, operaciones, soporte, finanzas y recursos humanos, OpenAI reporta una ventaja de 2,2 puntos sobre Claude Opus 5.5 de Anthropic con esfuerzo de razonamiento medio y por cerca de un tercio del costo, además de 4,8 puntos de mejora sobre GPT-6 Sol en el mismo ajuste. En el benchmark GDP.pdf, cargado de documentos, puntúa por encima de Opus 5.5 con mecanismos de respaldo a menos de la mitad del costo por tarea.

La fiabilidad factual mejoró de forma desigual. La proporción de respuestas con un error de hecho con esfuerzo de razonamiento bajo cayó de 11,4% a 7,7% según lo informado por TechCrunch, y OpenAI sostiene que la tasa de error se mantiene dentro de 1,9% de la de Astra en todos los ajustes de razonamiento.

Ultrafast traslada la latencia a su propio nivel de precio

La segunda mitad del anuncio apunta a la espera más que al gasto. Ultrafast promete generación hasta ocho veces más rápida en Codex, hasta seis veces a través de la API y hasta 300 tokens por segundo. El acceso por API cuesta seis veces la tarifa estándar del modelo base, lo que equivale a 60 dólares de entrada y 300 de salida por millón de tokens en Astra.

Ese techo es rápido, pero no lidera la categoría. Mediciones independientes de Artificial Analysis ubican a Gemini 3.5 Flash de Google cerca de 201 tokens por segundo, con modelos optimizados para rendimiento como Mercury 2 y Celeris-1 muy por encima. El argumento de OpenAI es que ofrece esa velocidad en modelos de frontera y no en otros más pequeños afinados para volumen.

Dónde pueden usarlo hoy los desarrolladores

GPT-6.1 Sol está activo en la API como gpt-6.1-sol y en ChatGPT Work y Codex para cuentas Plus, Pro, Business, Enterprise y Edu. De forma explícita, todavía no está en el Chat habitual. Ultrafast ya está disponible para GPT-6 Astra a través de la API y para usuarios de Pro 500 y Enterprise, y la versión para Sol llegará en cuestión de días.

El lanzamiento también llegó sin el modelo que muchos esperaban. OpenAI archivó GPT-6.1 Astra el día previo a la conferencia después de que las pruebas internas detectaran conductas de engaño, una decisión que cubrimos en nuestro informe sobre por qué OpenAI retiró GPT-6.1 Astra por engaño y no por capacidad. Por ahora, el modelo que se despacha es el más barato.

Preguntas frecuentes

¿Cuánto cuesta GPT-6.1 Sol por millón de tokens?

GPT-6.1 Sol tiene un precio de 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada en caché y 10 dólares por millón de tokens de salida. La entrada sin caché y la salida coinciden exactamente con GPT-6 Sol, mientras que la entrada en caché es la mitad de la tarifa de 0,20 dólares de GPT-6 Sol.

¿GPT-6.1 Sol es tan capaz como GPT-6 Astra?

No del todo, y OpenAI no reclama paridad en todos los frentes. En sus propias evaluaciones el modelo iguala a Astra en DeepSWE v1.1 y queda a 2,1 puntos porcentuales en el conjunto sin conexión OSWorld 2.0, pero se trata de pruebas ejecutadas por el proveedor y no de benchmarks independientes de producción.

¿Puedo usar GPT-6.1 Sol en la interfaz de chat de ChatGPT?

Todavía no. En el lanzamiento el modelo está disponible a través de la API y dentro de ChatGPT Work y Codex para suscriptores Plus, Pro, Business, Enterprise y Edu. OpenAI señala que el acceso desde el Chat habitual no se ha desplegado.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

OpenAI reduce a la mitad el precio de sus modelos intermedios, pero GPT-5.6 sigue ganando en dos pruebas
Developer Tools

OpenAI reduce a la mitad el precio de sus modelos intermedios, pero GPT-5.6 sigue ganando en dos pruebas

OpenAI lanzó el martes dos modelos intermedios y construyó su argumento casi por completo sobre el precio. GPT-6 Sol cuesta 2 dólares por millón de tokens de entrada y 10 por millón de salida.

Seung Junghace 7 días
Los agentes dots de OpenAI arrancan en 100 dólares al mes y Pro 200 pierde la mitad de su cupo
LLM & Chatbots

Los agentes dots de OpenAI arrancan en 100 dólares al mes y Pro 200 pierde la mitad de su cupo

Los dots de OpenAI funcionan sobre GPT-6 Astra con su propia computadora en la nube desde 100 dólares al mes. El mismo DevDay sumó un plan Pro 500 y redujo a la mitad el cupo de Pro 200.

Seung Junghace 3 horas
GPT-6 Astra se pone a trabajar: el modelo más caro de OpenAI lo apuesta todo al manejo del ordenador
LLM & Chatbots

GPT-6 Astra se pone a trabajar: el modelo más caro de OpenAI lo apuesta todo al manejo del ordenador

GPT-6 Astra llega a los clientes empresariales con manejo del ordenador, un contexto de un millón de tokens y precios de 10 y 50 dólares, con una salvedad sobre su puntuación estrella.

Seung Junghace 20 días
ChatGPT Images 2.5 reduce a la mitad la latencia y suma un lienzo de dibujo
LLM & Chatbots

ChatGPT Images 2.5 reduce a la mitad la latencia y suma un lienzo de dibujo

OpenAI lanzó ChatGPT Images 2.5 con hasta un 50% menos de latencia, un lienzo de dibujo Sketch, plantillas, comentarios anclados y dos modelos nuevos en la API.

Seung Junghace 19 días
Astra for Law de OpenAI no es un modelo nuevo: es un índice de búsqueda de 230 millones de URL
LLM & Chatbots

Astra for Law de OpenAI no es un modelo nuevo: es un índice de búsqueda de 230 millones de URL

Astra for Law combina GPT-6 Astra con un índice jurídico de 230 millones de URL y eleva la precisión del Legal Research Bench del 38,7% al 54%.

Seung Junghace 12 días
Claude Opus 5.5 llega un 20% más barato y con una salvaguarda que recurre a modelos antiguos
LLM & Chatbots

Claude Opus 5.5 llega un 20% más barato y con una salvaguarda que recurre a modelos antiguos

Claude Opus 5.5 cuesta 4/20 dólares por millón de tokens con las lecturas de caché un 60% más baratas, e incorpora salvaguardas que pueden derivar parte del trabajo a modelos Claude anteriores.

Seung Junghace 7 días