Cuatro peticiones válidas en Opus 5 ahora devuelven 400 en Claude Opus 5.5

Un quinto cambio no rompe nada, y es justo el que más probablemente llegue a tus usuarios.

|7 min de lectura0
A computer display of the kind where an Opus 5 request pattern rejected by Claude Opus 5.5 first shows up: as an HTTP 400 in the console.
A computer display of the kind where an Opus 5 request pattern rejected by Claude Opus 5.5 first shows up: as an HTTP 400 in the console.

Claude Opus 5.5, de Anthropic, llegó el 22 de septiembre a 4 dólares por millón de tokens de entrada, una quinta parte menos que Claude Opus 5. También rechaza cuatro patrones de petición que Opus 5 aceptaba, y cada uno vuelve como un HTTP 400 en lugar de degradarse en silencio. Las notas de migración de la propia Anthropic los enumeran juntos; The New Stack fue de los primeros en señalar que una rebaja de este tamaño viene con una migración adjunta.

Puntos clave

  • Cuatro patrones devuelven ahora un error 400 invalid_request_error en claude-opus-5-5: desactivar el thinking, forzar el uso de herramientas, reenviar un bloque de thinking después de cambiar el inicio del prompt y declarar la herramienta de computer use computer_20251124 en la API de Claude o en Google Cloud.
  • Los tres primeros también se aplican a Claude Fable 5.1, así que una sola pasada de migración cubre ambos modelos.
  • Un quinto cambio no lanza ningún error: el texto que el modelo escribe entre llamadas a herramientas llega ahora dentro de bloques de thinking que van vacíos con el ajuste por defecto display: "omitted", de modo que las aplicaciones que transmitían esas notas como avance simplemente se quedan mudas.

Qué devuelve ahora un 400

El thinking ya no es opcional. En Opus 5, thinking: {"type": "disabled"} se aceptaba con effort high o inferior. En Opus 5.5 el thinking adaptativo está siempre activo, y tanto ese ajuste como una asignación manual de budget_tokens devuelven un error de petición inválida. El reemplazo documentado es el parámetro effort: bájalo allí donde antes se apagaba el razonamiento.

Hay un efecto de segundo orden que conviene detectar pronto. El effort por defecto en Opus 5.5 es medium, mientras que en Opus 5 era high. Un equipo que nunca fijó el effort de forma explícita está cambiando por tanto dos variables a la vez: la forma de la petición y la cantidad de razonamiento detrás de cada respuesta.

El uso forzado de herramientas se va con ello. Los valores de tool_choice {"type": "any"} y {"type": "tool", "name": ...} fallan, y la misma validación corre en el endpoint de conteo de tokens, así que un conteo previo no avisará antes de la llamada real. Solo quedan auto y none. Si el objetivo era garantizar una forma JSON, Anthropic apunta al strict tool use o a la salida estructurada; si era simplemente lograr que el modelo tirase de una herramienta, eso pasa ahora al prompt.

Los bloques de thinking arrastran un modelo y un prefijo

El tercer cambio es el más sutil, porque falla de dos maneras distintas. Cada bloque de thinking registra qué modelo lo produjo, y cada modelo lee solo una parte del árbol familiar. Opus 5.5 lee bloques de Opus 5 y de modelos Opus, Sonnet y Haiku anteriores, pero no de los modelos Claude Fable ni Claude Mythos. En la API de Claude, solo Fable 5.1 y Mythos 5.1 pueden leer bloques producidos por Opus 5.5.

Al cruzar la frontera equivocada no se rompe nada: la API elimina el bloque ilegible antes de que el modelo lo vea, la petición tiene éxito y el bloque descartado no se factura. La conversación sigue en silencio sin su razonamiento previo. La única señal es el array de nivel superior input_transformations, que ni siquiera aparece sin la cabecera beta thinking-binding-controls-2026-08-01.

El 400 viene de una comprobación aparte. La API verifica que nada de lo que precede a un bloque de thinking —el prompt de sistema, las definiciones de herramientas, un mensaje anterior— haya cambiado desde que se generó el bloque, y lo exige por defecto en las cuentas creadas a partir del 31 de agosto de 2026 en la API de Claude y en las plataformas cloud. Reescribir un prompt de sistema a mitad de conversación es ahora un modo de fallo, no una costumbre. La solución documentada es mantener las conversaciones en modo solo-añadir y cambiar las instrucciones mediante mensajes de sistema intermedios en vez de ediciones.

Computer use pierde su herramienta antigua en dos plataformas

En la API de Claude y en Google Cloud, Opus 5.5 acepta computer use únicamente como el conjunto computer_toolset_20260801; una petición que declare la herramienta anterior computer_20251124 queda rechazada sin más. La excepción es Amazon Bedrock, donde la herramienta antigua sigue funcionando exactamente igual que en Opus 5.

Esa asimetría importa a quien corra el mismo agente de IA en varios proveedores, porque el payload idéntico pasará en Bedrock y fallará en la API de Claude. Migrar implica quitar la cabecera beta computer-use-2025-11-24, sustituir la entrada de tools y actualizar el bucle del agente para los bloques tool_use miembro, las acciones por lotes y el nombre del conjunto en los resultados. La herramienta de browser use no se ve afectada.

El cambio que no rompe nada y oculta lo máximo

Ninguno de los anteriores es el cambio que más probablemente noten los usuarios finales. Opus 5.5 devuelve las notas breves que escribe entre llamadas a herramientas como bloques de thinking de avance en lugar de bloques de texto. Con el ajuste de display por defecto esos bloques llegan con el campo de texto vacío, así que un producto que volcaba esas notas en una ventana de chat o en un registro de compilación ahora no muestra nada entre llamadas: sin error, sin código de estado y sin una línea de log que rastrear.

En una sesión de agente de larga duración, esa es la diferencia entre un usuario que ve avanzar el trabajo y un usuario que mira un spinner. Restaurarlo requiere un solo ajuste, thinking.display, pero solo si alguien repara antes en el silencio.

Qué integraciones tienen que cambiar de verdad

El radio de impacto es más estrecho de lo que sugiere hablar de cuatro cambios rompedores, y cae de forma desigual. Tres perfiles cargan con casi todo el trabajo. Las canalizaciones ajustadas por latencia que desactivaban el thinking para recortar segundos en una llamada de clasificación o de enrutamiento tienen que elegir un nivel de effort y volver a medir, porque ya no queda un ajuste de razonamiento cero al que recurrir. Los servicios de extracción que se apoyaban en el uso forzado de herramientas como garantía barata de esquema necesitan otro mecanismo, no otro valor.

El tercer grupo es el que probablemente se lleve la sorpresa. Los enrutadores multimodelo que cambian de modelo a mitad de conversación para controlar el coste tienen ahora una matriz de compatibilidad que respetar y, como el razonamiento incompatible se descarta en lugar de rechazarse, un enrutador puede degradar la calidad de las respuestas durante semanas sin una sola petición fallida a la que señalar. Todo lo que se limite a llamar a Opus 5 con el thinking ya activo y el conjunto actual de computer use queda intacto.

Qué volver a probar antes de desplegar

Hay dos cambios de comportamiento más que no lanzan nada. Opus 5.5 tiende a razonar más por turno con el mismo nivel de effort, sobre todo en xhigh y max, así que un barrido de effort heredado de Opus 5 quedará mal calibrado y max_tokens necesita margen para el razonamiento. El modelo también ejecuta un clasificador de salvaguarda en biología junto al de ciberseguridad, y puede rechazar peticiones que lo empujen a reproducir su razonamiento interno.

Los rechazos son la última trampa para el manejo de errores: devuelven HTTP 200 con stop_reason: "refusal" y un objeto stop_details que nombra el área de política, de modo que el código que se ramifica por código de estado los leerá como éxitos. Entre eso, los descartes silenciosos de bloques de thinking y las actualizaciones de progreso mudas, el patrón de esta versión es coherente: los fallos ruidosos son los fáciles. El precio que encabezó buena parte de la cobertura del lanzamiento, incluida la salvaguarda que deriva algunas tareas a modelos más antiguos, solo rinde una vez que las peticiones se procesan.

FAQ — Preguntas frecuentes

¿Claude Opus 5.5 admite el uso forzado de herramientas?

No. Fijar tool_choice en {"type": "any"} o {"type": "tool", "name": ...} devuelve un error 400 invalid_request_error en claude-opus-5-5. Solo se aceptan auto y none, y la misma validación se aplica al endpoint de conteo de tokens.

¿Se facturan los bloques de thinking descartados?

No. Cuando una petición lleva un bloque de thinking que el modelo de destino no puede leer, la API lo elimina antes de que el modelo lo vea y no lo factura. La petición sigue teniendo éxito, así que el descarte solo es visible a través del array input_transformations que se devuelve con la cabecera beta thinking-binding-controls-2026-08-01.

¿El cambio de computer use afecta a Amazon Bedrock?

No. La herramienta computer_20251124 sigue funcionando en Opus 5.5 a través de Amazon Bedrock igual que en Opus 5. La restricción se aplica a la API de Claude y a Google Cloud, donde solo se acepta el conjunto computer_toolset_20260801.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

Claude Code Projects vuelve como un coordinador que ejecuta hilos en la nube en paralelo
Developer Tools

Claude Code Projects vuelve como un coordinador que ejecuta hilos en la nube en paralelo

El rediseño de Claude Code Projects coloca un coordinador por encima de los hilos de trabajo, cada uno una sesión completa en la nube con su rama y memoria compartida.

Seung Junghace 10 días
Un millón de skills para agentes en siete meses, y casi la mitad se instaló una sola vez
Developer Tools

Un millón de skills para agentes en siete meses, y casi la mitad se instaló una sola vez

El registro skills.sh de Vercel llegó a un millón de skills en siete meses. Casi la mitad se instaló una sola vez y 375 fichas concentran el 62% de las instalaciones.

Seung Junganteayer
Docker lleva sus sandboxes para agentes de IA a la nube, con cobro por segundo desde 0,07 dólares la hora
Developer Tools

Docker lleva sus sandboxes para agentes de IA a la nube, con cobro por segundo desde 0,07 dólares la hora

Docker lanzó Cloud Sandboxes, que lleva su aislamiento por microVM para agentes a cómputo gestionado con cobro por segundo desde 0,07 dólares la hora, y cede Kits a la CNCF.

Seung Junghace 3 días
3.000 cambios fusionados y cero reversiones: así fue el sprint de dos semanas de Anthropic
Developer Tools

3.000 cambios fusionados y cero reversiones: así fue el sprint de dos semanas de Anthropic

Anthropic redujo en agosto el tiempo p75 hasta poder escribir en claude.ai de 3,1 a 0,55 segundos y fusionó 3.000 cambios sin una sola reversión al condicionar la CI al recuento de instrucciones.

Seung Junghace 4 días
AWS libera Strands Harness como código abierto y deja en el gráfico al rival que le ganó en costo
Developer Tools

AWS libera Strands Harness como código abierto y deja en el gráfico al rival que le ganó en costo

El equipo de Strands Agents de AWS publicó Strands Harness el 21 de septiembre bajo licencia Apache 2.0, para Python y TypeScript, con despliegue en una laptop o en cinco nubes.

Seung Junghace 6 días
Los reparadores con LLM rompieron código que funcionaba diez veces más a menudo de lo que arreglaron el defectuoso
Developer Tools

Los reparadores con LLM rompieron código que funcionaba diez veces más a menudo de lo que arreglaron el defectuoso

Un estudio en arXiv midió un bucle de reparación con LLM dañando programas correctos a 0,261 y arreglando los defectuosos a 0,023, y halló la dirección interna que lo impulsa.

Seung Junghace 15 días