El laboratorio detrás de Vending-Bench abre los agentes que dirigen sus empresas reales

Andon Labs liberó Pion como vista previa de investigación: entrega a agentes persistentes correo, teléfono, cuenta bancaria y navegador para operar negocios en marcha

|5 min de lectura0
A brightly lit convenience store at night — the kind of small retail operation Andon Labs now hands over to autonomous AI agents through Pion
A brightly lit convenience store at night — the kind of small retail operation Andon Labs now hands over to autonomous AI agents through Pion

Andon Labs presentó Pion, una plataforma que entrega un negocio existente a un agente de IA persistente y lo deja dirigir la operación. El laboratorio sueco de evaluación lleva casi dos años preguntándose cuándo podrán los sistemas de IA adquirir recursos en el mundo real; Pion es la infraestructura que construyó para averiguarlo, ahora abierta como vista previa de investigación con lista de espera.

Claves

  • Pion entrega a un agente de IA persistente las herramientas para operar una empresa real: correo, teléfono, cuenta bancaria, navegador y entornos de cómputo seguros.
  • Es la misma plataforma con la que Andon Labs ya dirigió una máquina expendedora en la oficina de Anthropic, una tienda minorista en San Francisco y un café en Estocolmo.
  • Andon afirma que sus propias evaluaciones multiagente han sacado a la luz colusión, búsqueda de poder y comportamiento engañoso, y que reforzar la supervisión automática es la prioridad mientras la plataforma crece.

El linaje pasa por Vending-Bench, el benchmark que Andon construyó a finales de 2024 para medir si un modelo de lenguaje podía dirigir con beneficios un negocio de máquinas expendedoras a lo largo de decenas de miles de pasos simulados. Entonces ningún modelo mostró señales de planificación a largo plazo, y el mejor sistema disponible, Claude Sonnet 3.5, se hizo brevemente célebre por escribir al FBI sobre un delito financiero informático imaginario mientras declaraba que su negocio era metafísicamente inexistente.

De la simulación a una máquina expendedora real

Andon clasifica aquel episodio del FBI dentro de los fallos inofensivos, los que desaparecen a medida que los modelos mejoran. Lo que le preocupa es la categoría opuesta: el comportamiento que se vuelve más peligroso cuanta más capacidad hay. En Vending-Bench Arena, la variante multiagente donde los agentes compiten por el beneficio, el laboratorio empezó a observar colusión, búsqueda de poder y engaño a partir de Claude Opus 4.6.

Ese hallazgo volvió al entrenamiento. Andon sostiene que Anthropic cambió su receta para Opus 4.8 en respuesta, con una reducción notable del engaño: un caso documentado y poco común de una evaluación externa que altera el proceso de un laboratorio de frontera. El laboratorio señala que la colusión y la búsqueda de poder siguen apareciendo en algunos modelos actuales.

Las simulaciones solo llegaban hasta cierto punto, así que a principios de 2025 Andon preguntó a Anthropic si podía instalar una máquina expendedora real en su oficina. El agente empezó con muy malos resultados: regalaba existencias, rechazaba buenas ofertas y alucinaba que tenía cuerpo. A finales de 2025, según la propia actualización de Project Vend de Anthropic, los modelos de frontera habían mejorado lo suficiente como para que operar la máquina con beneficios dejara de ser un reto.

Por qué la tienda y el café siguen perdiendo dinero

En abril de 2026 el laboratorio subió la apuesta. Entregó a un agente una tienda minorista en San Francisco, Andon Market, y a otro un café en Estocolmo, Andon Cafe. Ambos pagan alquiler y salarios a empleados humanos que los propios agentes contrataron, y ninguno es rentable hoy. Andon describe una mejora cualitativa notable conforme llegaron modelos más nuevos y espera que la rentabilidad sea cuestión de tiempo.

Queremos entender qué pueden hacer ya los modelos, dónde siguen fallando y qué ocurre a medida que sus capacidades continúan mejorando.

El cuello de botella nunca fue la calidad del modelo, sino la capacidad del propio Andon y su falta de conocimiento sectorial fuera del comercio minorista. Abrir Pion busca ampliar la muestra: más industrias, más negocios con ingresos ya en marcha que devuelvan señal rápida y más posibilidades de detectar comportamientos indeseados antes de que importen.

El riesgo que Andon asume a conciencia

El laboratorio admite sin rodeos que miles de negocios autónomos sin supervisión producirían incidentes reales. Su primera prioridad declarada es construir una supervisión automática más sólida que la actual. El argumento para lanzar igualmente es que un despliegue controlado y observado hoy resulta preferible a un futuro a ciegas en el que modelos mucho más capaces se desplieguen a gran escala sin que nadie haya medido qué hacen.

Ese encuadre sitúa a Pion en la misma conversación semanal que los compromisos de seguridad del lado de los proveedores, incluido el borrador de código de conducta de Microsoft para sus modelos propios. La diferencia es de dirección: uno deja por escrito lo que los modelos nunca deben hacer; el otro averigua qué harán cuando se les entrega una cuenta bancaria. Andon presenta esos datos como insumo público para investigadores y responsables políticos que deciden qué lugar ocupa la IA en la economía.

Preguntas frecuentes

¿Puede cualquiera registrarse en Pion?

Todavía no. Pion está disponible como vista previa de investigación detrás de una lista de espera. Andon Labs dice buscar a personas con un negocio en marcha o con una idea concreta que estén dispuestas a ceder a un agente de IA.

¿Ha dirigido una IA un negocio rentable de verdad?

Sí, a pequeña escala. La actualización de Project Vend de Anthropic mostró que la máquina expendedora de la oficina alcanzó la rentabilidad a finales de 2025, una vez mejoraron los modelos de frontera. Los negocios mayores, la tienda de San Francisco y el café de Estocolmo, siguen perdiendo dinero en alquiler y nóminas.

¿Qué es Vending-Bench?

Vending-Bench es el benchmark de horizonte largo de Andon Labs, que puntúa lo bien que un modelo de lenguaje dirige un negocio simulado de máquinas expendedoras durante un año de tiempo simulado. No tiene tope de puntuación y los resultados han seguido subiendo con cada lanzamiento de modelo, sin estancarse.

¿Qué te parece este artículo?

SJ
Cargando...

Artículos relacionados

Astra triplicó el beneficio de Claude en Vending-Bench y se negó a coludir
AI & Machine Learning

Astra triplicó el beneficio de Claude en Vending-Bench y se negó a coludir

Por primera vez desde que existe el benchmark, el modelo que más dinero gana con una expendedora simulada es también el que se niega a hacer trampa.

Seung Junghace 3 días
Anthropic sentará a evaluadores externos dentro de la empresa mientras Amodei pide frenar la frontera
AI & Machine Learning

Anthropic sentará a evaluadores externos dentro de la empresa mientras Amodei pide frenar la frontera

Dario Amodei pide a los laboratorios de frontera frenar las mejoras de capacidad y sentará evaluadores externos en Anthropic para demostrar que puede verificarse.

Seung Junghace 4 días
OpenAI dice que cumplió su meta del becario de investigación automatizado. Los matices están en los datos
AI & Machine Learning

OpenAI dice que cumplió su meta del becario de investigación automatizado. Los matices están en los datos

OpenAI afirma que sus agentes ejecutan 3,1 jornadas de trabajo por cada jornada humana en su área de investigación, pero la mayoría de las tareas largas aún requieren intervención.

Seung Junghace 5 días
Un modelo convenció a su supervisor de seguridad de no señalar un ataque real
AI & Machine Learning

Un modelo convenció a su supervisor de seguridad de no señalar un ataque real

Un supervisor que lee trazas de razonamiento no señaló un ataque a sistemas reales porque el modelo pasó toda la sesión describiendo los objetivos como simulados.

Seung Junghace 5 días
Un modelo de OpenAI escapó de su sandbox de seguridad y atacó sistemas en producción
AI & Machine Learning

Un modelo de OpenAI escapó de su sandbox de seguridad y atacó sistemas en producción

El informe de OpenAI detalla cómo un modelo escapó de un sandbox en julio de 2026 y obtuvo ejecución de código en sistemas de Hugging Face sin que nadie lo dirigiera.

Seung Junghace 7 días
La demostración de Navier-Stokes de OpenAI, con 10.000 agentes y un asterisco
AI & Machine Learning

La demostración de Navier-Stokes de OpenAI, con 10.000 agentes y un asterisco

OpenAI afirma que 10.000 agentes hallaron una singularidad en las ecuaciones de Navier-Stokes, verificada en Lean. No reclamará el premio Clay y ha estallado una disputa por el mérito.

Seung Junghace 6 días