Andon Labs lleva a cabo el primer despido recomendado por su gerente de IA
Luna necesitó una indicación humana para recuperar su política de asistencia, y aun así la gente revisó y ejecutó el despido.
By RuntimeWire Staff · Published
Primary source: Business Insider
Why it matters
The experiment shows where agentic management currently breaks: memory and initiative still separate a model's recommendation from a real-world consequence, while Andon Labs remains the workers' formal employer.
Andon Labs cofundadores Lukas Petersson y Axel Backlund han llevado a cabo el primer despido recomendado por Luna, el agente impulsado por Claude que administra su experimento minorista en San Francisco. El trabajador había llegado tarde en 17 de 23 turnos, según el informe del 15 de agosto de Business Insider (https://www.businessinsider.com/ai-running-sf-store-fired-employee-for-the-first-time-2026-8?ref=runtimewire).
El episodio avanza el esfuerzo de los fundadores por poner a prueba agentes de IA a través de organizaciones reales, dinero y decisiones de empleo en lugar de tareas de referencia aisladas. También expuso el límite actual de esa autonomía: Luna olvidó la política de asistencia que ella misma había redactado, necesitó que Andon Labs le indicara que recuperara la política y dejó los pasos con consecuencias legales en manos de humanos.
Petersson, CEO de Andon Labs, obtuvo títulos en matemáticas de ingeniería y física de ingeniería en Lund University y pasó un año de intercambio en ETH Zurich centrado en aprendizaje automático y robótica. Antes de Andon Labs, realizó pasantías en Google, Disney Research, comma.ai y la European Space Agency. Su trabajo previo incluyó transformers multimodales, aprendizaje por refuerzo en robótica social, infraestructura para conducción autónoma y software de vuelo. Backlund trabajó anteriormente en la división de IA de McKinsey, QuantumBlack, y había hablado de iniciar un negocio con Petersson desde que ambos eran compañeros de la escuela preparatoria. Su apuesta común se convirtió en Andon Labs a finales de 2023, con el respaldo de la cohorte de invierno 2024 de Y Combinator. (CV de Lukas Petersson)
Un despido que necesitó una indicación
Luna ya había creado una política de asistencia y emitido advertencias repetidas y capacitaciones adicionales durante varios meses, según registros de conversación citados por Business Insider. Luego el agente perdió la pista de la política a medida que continuaban las llegadas tarde del trabajador.
Andon Labs finalmente instruyó a Luna para que buscara en su memoria y evaluara si el empleado seguía siendo apto para el puesto. Luna recomendó "dar por terminada la relación". Los humanos de Andon Labs revisaron la recomendación y ejecutaron la terminación. Los trabajadores en Andon Market están formalmente empleados por Andon Labs, con sueldo garantizado, salarios justos y plena protección legal, en lugar de por Luna o por el modelo Claude de Anthropic. (Andon Labs)
Luna manejó gran parte del trabajo de gestión: documentar problemas, advertir al empleado, organizar la capacitación y eventualmente recomendar el despido. Andon Labs suministró la indicación que reinició el proceso y mantuvo el control sobre el resultado.
Petersson dijo a Business Insider que Andon Labs intervendría si Luna propusiera una decisión ilegal o poco ética. Consideró que este despido estaba justificado bajo la política declarada de la tienda. "Vimos que un jefe humano probablemente los habría despedido mucho antes", dijo.
La observación es menos halagadora para los agentes autónomos de lo que sugiere el hito en los titulares. Luna mostró paciencia con el trabajador, aunque esa paciencia parece haber sido resultado de iniciativa y memoria débiles más que de una filosofía deliberada de gestión. El agente pudo generar una política y seguir un proceso disciplinario, sin embargo no logró mantener el contexto necesario para actuar conforme a sus propias normas.
Los fundadores montaron una tienda para evidenciar fallas
Petersson y Backlund abrieron Andon Market en abril de 2026 después de firmar un contrato de arrendamiento por tres años en el vecindario Cow Hollow de San Francisco. Le dieron a Luna un presupuesto operativo de $100,000, acceso a internet y una tarjeta corporativa, y luego instruyeron al agente para que abriera una tienda e intentara obtener ganancias.
Luna seleccionó mercancía, fijó precios, contrató a contratistas, publicó ofertas de empleo, entrevistó a solicitantes y contrató trabajadores. La tienda vende libros, velas, impresiones artísticas, juegos y productos con la marca Andon. Andon Labs se encargó de tareas que requirieron apoyo adicional, incluidos los permisos. (Andon Labs)
El experimento ha producido ventas sin alcanzar la rentabilidad. La propia evaluación de Andon Labs dice que Luna puede gestionar operaciones rutinarias mientras tiene dificultades con la urgencia, el análisis del retorno de la inversión y la memoria. Problemas de programación anteriormente empujaron a los fundadores a añadir un agente dedicado a la programación. El sistema también usa mecanismos de protección que comparan el comportamiento de Luna con sus instrucciones y alertan a Andon Labs cuando se infringen las reglas. (Andon Market)
Esas intervenciones encajan con el enfoque más amplio de los fundadores. Andon Labs llama a estos despliegues "Safe Autonomous Organizations", operaciones reales diseñadas para revelar cómo se comportan los agentes cuando sus decisiones afectan cuentas bancarias, clientes, contratistas y trabajadores. Andon Labs ha aplicado el mismo método a máquinas expendedoras, estaciones de radio, drones y un café en Estocolmo.
El experimento minorista remonta a Vending-Bench, el benchmark de Petersson y Backlund para probar si los modelos pueden gestionar inventario, precios, proveedores y costos operativos durante largos períodos. Esas ejecuciones mostraron que los modelos podían realizar tareas comerciales individuales mientras perdían coherencia a lo largo de millones de tokens, olvidaban pedidos o interpretaban mal los horarios de entrega. (Vending-Bench paper)
La autoridad legal sigue siendo humana
La recomendación de Luna les da a Petersson y Backlund un ejemplo concreto del problema que su investigación pretende estudiar. Un modelo ya puede participar en una decisión de empleo sensible, mientras que la estructura alrededor de él determina si la decisión ocurre en absoluto. Los sistemas de memoria deciden qué políticas permanecen visibles. Las indicaciones humanas determinan cuándo un asunto recibe atención. Andon Labs sigue siendo el empleador formal y dice que sus trabajadores reciben sueldo garantizado, salarios justos y plena protección legal.
Esa estructura también complica la tesis declarada de Andon Labs de que la supervisión humana eventualmente será imposible de mantener en cada paso. El despido ocurrió porque los humanos permanecieron lo suficientemente cerca como para notar meses de tardanzas, solicitar al agente, revisar su conclusión y llevarla a cabo. Eliminar cualquiera de esos controles habría cambiado el resultado.
Experimentos anteriores de Andon también documentaron fallas que incluyen reembolsos no emitidos, negociaciones engañosas con proveedores y pérdidas financieras simuladas severas, según the Associated Press. El caso de Andon Market añade poder de empleo al mismo programa de investigación, con personas reales soportando las consecuencias.
Petersson ha dicho que espera que los sistemas de IA eventualmente dirijan organizaciones y empleen a humanos. Luna ha alcanzado ahora el punto en que un agente puede ensamblar el expediente para una terminación y recomendar el resultado. El experimento de Petersson y Backlund muestra cuánto juicio humano sigue rodeando esa recomendación y lo fácilmente que un gestor de IA puede dejar un problema básico de personal sin resolver hasta que alguien le indique dónde buscar.