Claude Opus 5.5, de Anthropic, llegó el 22 de septiembre a 4 dólares por millón de tokens de entrada, una quinta parte menos que Claude Opus 5. También rechaza cuatro patrones de petición que Opus 5 aceptaba, y cada uno vuelve como un HTTP 400 en lugar de degradarse en silencio. Las notas de migración de la propia Anthropic los enumeran juntos; The New Stack fue de los primeros en señalar que una rebaja de este tamaño viene con una migración adjunta.
Puntos clave
- Cuatro patrones devuelven ahora un error 400 invalid_request_error en
claude-opus-5-5: desactivar el thinking, forzar el uso de herramientas, reenviar un bloque de thinking después de cambiar el inicio del prompt y declarar la herramienta de computer usecomputer_20251124en la API de Claude o en Google Cloud. - Los tres primeros también se aplican a Claude Fable 5.1, así que una sola pasada de migración cubre ambos modelos.
- Un quinto cambio no lanza ningún error: el texto que el modelo escribe entre llamadas a herramientas llega ahora dentro de bloques de thinking que van vacíos con el ajuste por defecto
display: "omitted", de modo que las aplicaciones que transmitían esas notas como avance simplemente se quedan mudas.
Qué devuelve ahora un 400
El thinking ya no es opcional. En Opus 5, thinking: {"type": "disabled"} se aceptaba con effort high o inferior. En Opus 5.5 el thinking adaptativo está siempre activo, y tanto ese ajuste como una asignación manual de budget_tokens devuelven un error de petición inválida. El reemplazo documentado es el parámetro effort: bájalo allí donde antes se apagaba el razonamiento.
Hay un efecto de segundo orden que conviene detectar pronto. El effort por defecto en Opus 5.5 es medium, mientras que en Opus 5 era high. Un equipo que nunca fijó el effort de forma explícita está cambiando por tanto dos variables a la vez: la forma de la petición y la cantidad de razonamiento detrás de cada respuesta.
El uso forzado de herramientas se va con ello. Los valores de tool_choice {"type": "any"} y {"type": "tool", "name": ...} fallan, y la misma validación corre en el endpoint de conteo de tokens, así que un conteo previo no avisará antes de la llamada real. Solo quedan auto y none. Si el objetivo era garantizar una forma JSON, Anthropic apunta al strict tool use o a la salida estructurada; si era simplemente lograr que el modelo tirase de una herramienta, eso pasa ahora al prompt.
Los bloques de thinking arrastran un modelo y un prefijo
El tercer cambio es el más sutil, porque falla de dos maneras distintas. Cada bloque de thinking registra qué modelo lo produjo, y cada modelo lee solo una parte del árbol familiar. Opus 5.5 lee bloques de Opus 5 y de modelos Opus, Sonnet y Haiku anteriores, pero no de los modelos Claude Fable ni Claude Mythos. En la API de Claude, solo Fable 5.1 y Mythos 5.1 pueden leer bloques producidos por Opus 5.5.
Al cruzar la frontera equivocada no se rompe nada: la API elimina el bloque ilegible antes de que el modelo lo vea, la petición tiene éxito y el bloque descartado no se factura. La conversación sigue en silencio sin su razonamiento previo. La única señal es el array de nivel superior input_transformations, que ni siquiera aparece sin la cabecera beta thinking-binding-controls-2026-08-01.
El 400 viene de una comprobación aparte. La API verifica que nada de lo que precede a un bloque de thinking —el prompt de sistema, las definiciones de herramientas, un mensaje anterior— haya cambiado desde que se generó el bloque, y lo exige por defecto en las cuentas creadas a partir del 31 de agosto de 2026 en la API de Claude y en las plataformas cloud. Reescribir un prompt de sistema a mitad de conversación es ahora un modo de fallo, no una costumbre. La solución documentada es mantener las conversaciones en modo solo-añadir y cambiar las instrucciones mediante mensajes de sistema intermedios en vez de ediciones.
Computer use pierde su herramienta antigua en dos plataformas
En la API de Claude y en Google Cloud, Opus 5.5 acepta computer use únicamente como el conjunto computer_toolset_20260801; una petición que declare la herramienta anterior computer_20251124 queda rechazada sin más. La excepción es Amazon Bedrock, donde la herramienta antigua sigue funcionando exactamente igual que en Opus 5.
Esa asimetría importa a quien corra el mismo agente de IA en varios proveedores, porque el payload idéntico pasará en Bedrock y fallará en la API de Claude. Migrar implica quitar la cabecera beta computer-use-2025-11-24, sustituir la entrada de tools y actualizar el bucle del agente para los bloques tool_use miembro, las acciones por lotes y el nombre del conjunto en los resultados. La herramienta de browser use no se ve afectada.
El cambio que no rompe nada y oculta lo máximo
Ninguno de los anteriores es el cambio que más probablemente noten los usuarios finales. Opus 5.5 devuelve las notas breves que escribe entre llamadas a herramientas como bloques de thinking de avance en lugar de bloques de texto. Con el ajuste de display por defecto esos bloques llegan con el campo de texto vacío, así que un producto que volcaba esas notas en una ventana de chat o en un registro de compilación ahora no muestra nada entre llamadas: sin error, sin código de estado y sin una línea de log que rastrear.
En una sesión de agente de larga duración, esa es la diferencia entre un usuario que ve avanzar el trabajo y un usuario que mira un spinner. Restaurarlo requiere un solo ajuste, thinking.display, pero solo si alguien repara antes en el silencio.
Qué integraciones tienen que cambiar de verdad
El radio de impacto es más estrecho de lo que sugiere hablar de cuatro cambios rompedores, y cae de forma desigual. Tres perfiles cargan con casi todo el trabajo. Las canalizaciones ajustadas por latencia que desactivaban el thinking para recortar segundos en una llamada de clasificación o de enrutamiento tienen que elegir un nivel de effort y volver a medir, porque ya no queda un ajuste de razonamiento cero al que recurrir. Los servicios de extracción que se apoyaban en el uso forzado de herramientas como garantía barata de esquema necesitan otro mecanismo, no otro valor.
El tercer grupo es el que probablemente se lleve la sorpresa. Los enrutadores multimodelo que cambian de modelo a mitad de conversación para controlar el coste tienen ahora una matriz de compatibilidad que respetar y, como el razonamiento incompatible se descarta en lugar de rechazarse, un enrutador puede degradar la calidad de las respuestas durante semanas sin una sola petición fallida a la que señalar. Todo lo que se limite a llamar a Opus 5 con el thinking ya activo y el conjunto actual de computer use queda intacto.
Qué volver a probar antes de desplegar
Hay dos cambios de comportamiento más que no lanzan nada. Opus 5.5 tiende a razonar más por turno con el mismo nivel de effort, sobre todo en xhigh y max, así que un barrido de effort heredado de Opus 5 quedará mal calibrado y max_tokens necesita margen para el razonamiento. El modelo también ejecuta un clasificador de salvaguarda en biología junto al de ciberseguridad, y puede rechazar peticiones que lo empujen a reproducir su razonamiento interno.
Los rechazos son la última trampa para el manejo de errores: devuelven HTTP 200 con stop_reason: "refusal" y un objeto stop_details que nombra el área de política, de modo que el código que se ramifica por código de estado los leerá como éxitos. Entre eso, los descartes silenciosos de bloques de thinking y las actualizaciones de progreso mudas, el patrón de esta versión es coherente: los fallos ruidosos son los fáciles. El precio que encabezó buena parte de la cobertura del lanzamiento, incluida la salvaguarda que deriva algunas tareas a modelos más antiguos, solo rinde una vez que las peticiones se procesan.
FAQ — Preguntas frecuentes
¿Claude Opus 5.5 admite el uso forzado de herramientas?
No. Fijar tool_choice en {"type": "any"} o {"type": "tool", "name": ...} devuelve un error 400 invalid_request_error en claude-opus-5-5. Solo se aceptan auto y none, y la misma validación se aplica al endpoint de conteo de tokens.
¿Se facturan los bloques de thinking descartados?
No. Cuando una petición lleva un bloque de thinking que el modelo de destino no puede leer, la API lo elimina antes de que el modelo lo vea y no lo factura. La petición sigue teniendo éxito, así que el descarte solo es visible a través del array input_transformations que se devuelve con la cabecera beta thinking-binding-controls-2026-08-01.
¿El cambio de computer use afecta a Amazon Bedrock?
No. La herramienta computer_20251124 sigue funcionando en Opus 5.5 a través de Amazon Bedrock igual que en Opus 5. La restricción se aplica a la API de Claude y a Google Cloud, donde solo se acepta el conjunto computer_toolset_20260801.






