El Claude Opus 5.5 de Anthropic ha dejado casi por completo de usar la raya, el signo de puntuación que se convirtió en atajo para señalar prosa escrita por una máquina. Un estudio de seguimiento publicado el 1 de octubre por la firma de investigación Graphite midió el modelo en 0,015 rayas por cada 1.000 palabras, frente a 2,92 en Opus 5: una reducción del 99%. El resto de la huella del modelo sobrevivió casi sin tocar.
Claves
- Opus 5.5 usa 0,015 rayas por 1.000 palabras frente a 2,92 de Opus 5, una caída del 99%.
- Graphite siguió contando 2.548 marcas distintas en los textos de Opus 5.5, solo un 4% menos que las 2.666 que halló en Opus 5.
- La expresión "this matters" aparece 116 veces más en la prosa de Opus 5.5 que en un corpus de artículos escritos antes de que ChatGPT se lanzara.
Graphite define una marca como la palabra, expresión o estructura de frase que un modelo emplea al menos el doble que los autores humanos. Con ese criterio, Opus 5.5 arrastra 2.548, por debajo de las 2.666 de Opus 5. Borrar el hábito más reconocible de la prosa generada movió el total apenas un cuatro por ciento.
Qué expresiones delatan a Opus 5.5
La palabra más llamativa del estudio es "dependable", a la que Opus 5.5 recurre 23 veces más que el grupo humano de control. Su hábito estructural más marcado es la obsesión por subrayar la importancia de lo que cuenta: "this matters" aparece 116 veces más que en el texto humano, y la fórmula "why _ matters", 92 veces más.
El modelo también ha abandonado la construcción "it's not X, it's Y" que definió a las versiones anteriores de Claude. Gregory Druck, director de inteligencia artificial de Graphite, explicó a TechCrunch que su lugar lo ocupó un pariente cercano: ahora el modelo prefiere decir que algo es más que una X, es una Y.
Cómo construyó Graphite el corpus
El método viene del informe del 16 de septiembre de Graphite, que reunió 10.000 artículos publicados antes del lanzamiento de ChatGPT como referencia humana y luego pidió a nueve grandes modelos de lenguaje de frontera que reescribieran cada uno a partir de un resumen. De ahí salieron 90.000 artículos de máquina sobre temas equiparados, lo que elimina el sesgo temático que arruina la mayoría de las comparaciones de estilo.
Comparar las tasas de uso normalizadas por longitud sacó a la luz 12.877 marcas únicas en los nueve modelos, con un reparto de entre 2.355 y 3.746 por modelo. Cerca del 65% pertenecía a una sola familia. Otras medidas separaron los dos grupos con la misma nitidez: los artículos de IA promediaron entre 5,2 y 5,7 caracteres por palabra frente a 4,9 de los humanos, y la longitud de sus frases varió mucho menos.
Dónde dejan su marca los modelos rivales
El GPT-6 Astra de OpenAI se apoya en el encuadre correctivo: define un asunto por lo que no es, con construcciones como "not simply X" o "rather than relying on X". Graphite situó ese hábito en unas 12 veces la tasa humana. El Gemini 3.1 Pro de Google prefiere en cambio intensificadores como "absolutely" y "highly", 13 veces por encima de los humanos, junto a transiciones formales del tipo "furthermore".
En la puntuación de prosa afectada de Graphite, Opus 5 y Gemini 3.1 Pro se situaron cerca de 2,5 veces la referencia humana, mientras Astra midió 1,2 veces. Opus 5.5 bajó su propia puntuación de 16,75 a 10,57, un recorte del 37% que aun así lo deja alrededor de 1,6 veces el nivel humano. Su distribución general de palabras también derivó hacia el texto humano: la divergencia de unigramas cayó de 0,064 a 0,052.
Por qué las marcas siempre vuelven
Druck contó a TechCrunch que la distribución de palabras de Claude se ha acercado al texto humano versión tras versión, mientras los modelos de OpenAI se han alejado. También dijo que el recuento total de marcas se mantiene estable en lugar de bajar: los laboratorios eliminan las más conocidas y en su lugar afloran hábitos nuevos, distintos en cada lanzamiento. Lo atribuyó a la escala, con el argumento de que un modelo con miles de millones de parámetros desborda cualquier conjunto finito de pruebas que un laboratorio pueda ejecutar antes de publicarlo.
Ambos laboratorios habían presumido de avances justo en ese terreno. El anuncio de Opus 5.5 de Anthropic sostenía que el modelo se comunica con más naturalidad que sus predecesores y que los primeros usuarios encontraron su escritura más clara y fácil de seguir. OpenAI hizo una promesa parecida con las versiones GPT-6 de Sol y Luna: más claridad, menos jerga y menos giros extraños.
Qué implica para la detección de IA
La lección práctica para editores y empresas de detección es que las heurísticas de una sola señal envejecen rápido, porque cualquier marca lo bastante famosa para resultar útil lo es también para acabar lijada durante el entrenamiento posterior. Graphite afirma que los datos de marcas y el corpus original de artículos se pueden descargar, lo que entrega a quien construye clasificadores un vocabulario por modelo y a los laboratorios una lista de verificación. Nuestro reportaje anterior sobre el hallazgo de Pew de que el 35% de las páginas web posteriores a ChatGPT muestran señales de autoría por IA da la medida de cuánto texto abarca ya la pregunta.
Preguntas frecuentes
¿Sigue siendo la raya un detector fiable de IA?
No. Graphite midió 0,015 rayas por 1.000 palabras en Opus 5.5, un 99% por debajo de Opus 5, y comprobó que Gemini 3.1 Pro casi ha eliminado el signo. GPT-6 Astra lo usa un 88% menos que el corpus humano anterior a ChatGPT, así que hoy su ausencia dice más sobre el entrenamiento reciente que su presencia.
¿Cuántas marcas de escritura de IA encontró Graphite en total?
El informe de septiembre identificó 12.877 palabras, expresiones y estructuras únicas que la IA usa al menos el doble que los humanos en nueve modelos. Cada modelo aportó entre 2.355 y 3.746, y alrededor del 65% de las marcas era específico de una sola familia.
¿Se pueden verificar los datos de forma independiente?
Sí. Graphite indica que los datos de marcas y el corpus original de artículos se descargan desde la página del informe. El seguimiento de octubre aplica el mismo método a Claude Opus 5.5 y detalla sus ratios por expresión frente a la referencia humana.






