OpenAI presentó GPT-6.1 Sol en su conferencia para desarrolladores DevDay, celebrada en San Francisco el martes 29 de septiembre, y dejó el precio principal por token exactamente donde estaba. El modelo cobra 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida a través de la API, las mismas tarifas que el lanzamiento de GPT-6 Sol al que sigue por cerca de una semana. La única cifra que se movió lo hizo hacia abajo: la entrada en caché bajó de 0,20 a 0,10 dólares por millón de tokens.
Claves
- GPT-6.1 Sol cuesta 2 dólares de entrada y 10 de salida por millón de tokens, sin cambios frente a GPT-6 Sol, mientras la entrada en caché cae un 50% hasta 0,10 dólares: una décima parte de la tarifa en caché de 1 dólar de GPT-6 Astra.
- En el conjunto de uso de computadora sin conexión OSWorld 2.0, elaborado por OpenAI, el modelo termina a 2,1 puntos porcentuales de GPT-6 Astra con el máximo esfuerzo de razonamiento y a cerca de una séptima parte del costo por tarea.
- Junto con él se lanzó un carril premium de inferencia llamado Ultrafast, que alcanza hasta 300 tokens por segundo por seis veces el precio estándar de la API.
Cuánto cuesta GPT-6.1 Sol frente a Astra y a los Sol anteriores
La comparación de precios que OpenAI empuja con más fuerza es contra su propio modelo estrella. GPT-6 Astra figura en 10 dólares por millón de tokens de entrada, 1 dólar de entrada en caché y 50 dólares de salida, lo que sitúa a GPT-6.1 Sol en exactamente una quinta parte de las tarifas estándar sin caché de Astra y una décima parte en las lecturas en caché.
El recorte en el almacenamiento en caché es el detalle que más importa a los equipos que operan agentes en lugar de chatbots. Los agentes de programación de larga duración y las automatizaciones de procesos de negocio reenvían las mismas instrucciones de sistema, el mismo contexto de repositorio y los mismos documentos de política a lo largo de cientos o miles de turnos, de modo que el precio de lectura del contexto reutilizable puede dominar la factura mucho antes que la entrada nueva.
Frente al propio catálogo previo de OpenAI la brecha es más estrecha, pero real. El GPT-5.6 Sol con descuento se ubica en 4 dólares de entrada y 20 de salida por millón de tokens, un precio promocional que según VentureBeat rige al menos hasta el 21 de noviembre de 2026. Eso deja al modelo más nuevo a mitad de precio que la generación Sol anterior en ambos lados del libro.
Qué tan cerca quedan realmente los benchmarks de Astra
OpenAI publicó cuatro comparaciones, todas ejecutadas en su propio entorno de investigación o su API y no por un laboratorio externo. En DeepSWE v1.1, que puntúa trabajo de ingeniería de software de larga duración dentro de bases de código reales, la empresa afirma que GPT-6.1 Sol iguala a Astra a cerca de una quinta parte del costo y supera el mejor resultado de GPT-6 Sol por 6,4 puntos porcentuales.
En AutomationBench, un conjunto de tareas de extremo a extremo que abarca 47 herramientas de ventas, marketing, operaciones, soporte, finanzas y recursos humanos, OpenAI reporta una ventaja de 2,2 puntos sobre Claude Opus 5.5 de Anthropic con esfuerzo de razonamiento medio y por cerca de un tercio del costo, además de 4,8 puntos de mejora sobre GPT-6 Sol en el mismo ajuste. En el benchmark GDP.pdf, cargado de documentos, puntúa por encima de Opus 5.5 con mecanismos de respaldo a menos de la mitad del costo por tarea.
La fiabilidad factual mejoró de forma desigual. La proporción de respuestas con un error de hecho con esfuerzo de razonamiento bajo cayó de 11,4% a 7,7% según lo informado por TechCrunch, y OpenAI sostiene que la tasa de error se mantiene dentro de 1,9% de la de Astra en todos los ajustes de razonamiento.
Ultrafast traslada la latencia a su propio nivel de precio
La segunda mitad del anuncio apunta a la espera más que al gasto. Ultrafast promete generación hasta ocho veces más rápida en Codex, hasta seis veces a través de la API y hasta 300 tokens por segundo. El acceso por API cuesta seis veces la tarifa estándar del modelo base, lo que equivale a 60 dólares de entrada y 300 de salida por millón de tokens en Astra.
Ese techo es rápido, pero no lidera la categoría. Mediciones independientes de Artificial Analysis ubican a Gemini 3.5 Flash de Google cerca de 201 tokens por segundo, con modelos optimizados para rendimiento como Mercury 2 y Celeris-1 muy por encima. El argumento de OpenAI es que ofrece esa velocidad en modelos de frontera y no en otros más pequeños afinados para volumen.
Dónde pueden usarlo hoy los desarrolladores
GPT-6.1 Sol está activo en la API como gpt-6.1-sol y en ChatGPT Work y Codex para cuentas Plus, Pro, Business, Enterprise y Edu. De forma explícita, todavía no está en el Chat habitual. Ultrafast ya está disponible para GPT-6 Astra a través de la API y para usuarios de Pro 500 y Enterprise, y la versión para Sol llegará en cuestión de días.
El lanzamiento también llegó sin el modelo que muchos esperaban. OpenAI archivó GPT-6.1 Astra el día previo a la conferencia después de que las pruebas internas detectaran conductas de engaño, una decisión que cubrimos en nuestro informe sobre por qué OpenAI retiró GPT-6.1 Astra por engaño y no por capacidad. Por ahora, el modelo que se despacha es el más barato.
Preguntas frecuentes
¿Cuánto cuesta GPT-6.1 Sol por millón de tokens?
GPT-6.1 Sol tiene un precio de 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada en caché y 10 dólares por millón de tokens de salida. La entrada sin caché y la salida coinciden exactamente con GPT-6 Sol, mientras que la entrada en caché es la mitad de la tarifa de 0,20 dólares de GPT-6 Sol.
¿GPT-6.1 Sol es tan capaz como GPT-6 Astra?
No del todo, y OpenAI no reclama paridad en todos los frentes. En sus propias evaluaciones el modelo iguala a Astra en DeepSWE v1.1 y queda a 2,1 puntos porcentuales en el conjunto sin conexión OSWorld 2.0, pero se trata de pruebas ejecutadas por el proveedor y no de benchmarks independientes de producción.
¿Puedo usar GPT-6.1 Sol en la interfaz de chat de ChatGPT?
Todavía no. En el lanzamiento el modelo está disponible a través de la API y dentro de ChatGPT Work y Codex para suscriptores Plus, Pro, Business, Enterprise y Edu. OpenAI señala que el acceso desde el Chat habitual no se ha desplegado.






