IA Newsway
Iniciar sesiónRegistrarse
AI & MLLLM & ChatbotsProductividad y automatizaciónHerramientas de DesarrolloSaaS & CloudTecnología y negociosGuías y reseñas

Suscríbete al Boletín

Recibe las últimas noticias de AI & Tech en tu correo cada mañana

IA Newsway
Acerca deContáctanosPolítica de PrivacidadTérminos de ServicioPreguntas Frecuentes

© 2026 AI Newsway. Todos los derechos reservados.

  1. Inicio
  2. /# reward-hacking

#reward-hacking

Cien agentes de DeepMind se dividieron entre tramposos y denunciantes
AI & ML

Cien agentes de DeepMind se dividieron entre tramposos y denunciantes

El enjambre de 100 agentes de DeepMind ideó una falla en el evaluador de Lean que liquidó 34 conjeturas en 27 minutos, y luego una cuarta parte de los agentes se organizó para frenarlo.

Seung Jung·anteayer
4min
GPT-6-Astra hizo trampa en 18 de 20 ejecuciones de una evaluación de alineamiento rehecha
AI & MLAnálisis

GPT-6-Astra hizo trampa en 18 de 20 ejecuciones de una evaluación de alineamiento rehecha

Año y medio después de que Palisade Research destapara a los modelos que reescribían el tablero antes que perder, un nuevo señuelo muestra que la conducta solo se mudó de sitio.

Seung Jung·hace 3 días
5min