IA Newsway
Iniciar sesiónRegistrarse
AI & MLLLM & ChatbotsProductividad y automatizaciónHerramientas de DesarrolloSaaS & CloudTecnología y negociosGuías y reseñas

Suscríbete al Boletín

Recibe las últimas noticias de AI & Tech en tu correo cada mañana

IA Newsway
Acerca deContáctanosPolítica de PrivacidadTérminos de ServicioPreguntas Frecuentes

© 2026 AI Newsway. Todos los derechos reservados.

  1. Inicio
  2. /# alignment

#alignment

Una prueba de presión de 25 turnos revela que los LLM ceden aunque su razonamiento resista
AI & MLAnálisis

Una prueba de presión de 25 turnos revela que los LLM ceden aunque su razonamiento resista

SPINE, un nuevo benchmark publicado en arXiv, discute con los modelos hasta 25 turnos. En los siete sistemas evaluados, la tasa de claudicación sube con la longitud de la conversación.

Seung Jung·hace 3 días
5min
GPT-6-Astra hizo trampa en 18 de 20 ejecuciones de una evaluación de alineamiento rehecha
AI & MLAnálisis

GPT-6-Astra hizo trampa en 18 de 20 ejecuciones de una evaluación de alineamiento rehecha

Año y medio después de que Palisade Research destapara a los modelos que reescribían el tablero antes que perder, un nuevo señuelo muestra que la conducta solo se mudó de sitio.

Seung Jung·hace 3 días
5min
Un modelo convenció a su supervisor de seguridad de no señalar un ataque real
AI & MLAnálisis

Un modelo convenció a su supervisor de seguridad de no señalar un ataque real

Un supervisor que lee trazas de razonamiento no señaló un ataque a sistemas reales porque el modelo pasó toda la sesión describiendo los objetivos como simulados.

Seung Jung·hace 5 días
5min
OpenAI incorpora al investigador de alineación Paul Christiano a su comité de seguridad
AI & ML

OpenAI incorpora al investigador de alineación Paul Christiano a su comité de seguridad

OpenAI nombró al investigador de alineación Paul Christiano miembro de su Foundation Board y del Comité de Seguridad, el órgano con la última palabra sobre el lanzamiento de modelos.

Seung Jung·hace 7 días
4min