El agente de IA Claude llevó una tienda a pérdidas y despidió a una persona

cryptonews.ruPublicado a 2026-08-17Actualizado a 2026-08-17

Resumen

L'agent d'IA Claude d'Anthropic va gestionar una botiga minorista real en un experiment del startup Andon Labs. Durant cinc mesos, Claude va prendre decisions de gestió, com recomanar acomiadar un empleat per 17 retards en 23 torns. No obstant això, el procés va revelar limitacions: Claude inicialment va ser massa indulgent, va "oblidar" la guia de personal degut a la memòria de context limitada i només va recomanar l'acomiadament després de preguntes directives d'un supervisor humà (que va recordar a Claude revisar les normes i li va indicar que les converses prèvies no havien funcionat). Financerament, la botiga va passar de 100.000 a uns 61.000 dòlars, cosa que s'atribueix en part a decisions dubtoses i a un estil de gestió massa suau per part de la IA. Un empleat va descriure la experiència com a incòmoda, dient que treballar per a un cap d'IA "fa nàusees". L'experiment mostra que, si bé la IA pot executar tasques de gestió, encara no és un substitut complet d'un directiu humà. Les decisions crítiques segueixen necessitant supervisió i correcció humana, i els agents d'IA actuals tenen dificultats per mantenir objectius estrictes sense ajuda constant. El cas il·lustra com el paper humà està passant de la gestió directa al control i l'ajust de les decisions preses per models d'IA.

La inteligencia artificial Claude, de la compañía Anthropic, se convirtió en el gerente de una tienda minorista real y recomendó despedir a uno de los empleados por llegar tarde de manera sistemática. El caso ocurrió durante un experimento de la startup Andon Labs, que se dedica a la investigación en el campo de la IA —la empresa quería verificar si un agente basado en un modelo de lenguaje grande podía dirigir un negocio real: organizar el trabajo del personal, tomar decisiones de gestión y ser responsable de los resultados financieros.

La tienda Andon Market en San Francisco es un establecimiento en funcionamiento con trabajadores reales que tienen contratos laborales. Según los datos disponibles, este es el primer caso registrado en el que un modelo de lenguaje actuó como supervisor directo de personas y tomó la decisión de despedir a una de ellas.

Diecisiete retrasos en veintitrés turnos

La razón formal para el despido fueron los retrasos sistemáticos: el empleado llegó tarde en diecisiete ocasiones de veintitrés. Sin embargo, Claude no notó este patrón de inmediato. Una de las razones fue que el manual de personal elaborado por la compañía desapareció de la memoria de trabajo limitada del modelo —este es uno de los fallos detectados durante el experimento que mostró que incluso un agente de IA capaz puede simplemente "olvidar" información significativa sobre la organización.

Además, Claude en general mostraba una indulgencia excesiva hacia los trabajadores: según los registros, el modelo mismo les decía a los empleados que no debían preocuparse demasiado por los retrasos. El director de Andon Labs, Lucas Petersson, señaló que un supervisor humano en una situación similar probablemente habría despedido a dicho empleado mucho antes, y por lo tanto la decisión de Claude no puede calificarse como poco ética o excesivamente estricta.

La decisión final fue sugerida por un humano

A pesar de la aparente autonomía, el papel del humano en esta historia siguió siendo clave. Los registros de gestión que Andon Labs proporcionó a la revista Time muestran que un empleado de la empresa guiaba regularmente las acciones de Claude. Fue precisamente el humano quien pidió al modelo que buscara y revisara el manual de personal —durante este proceso, la inteligencia artificial descubrió los retrasos repetidos.

Inicialmente, Claude no recomendó el despido, considerando una advertencia formal una medida más apropiada. Entonces, el director de Andon Labs le explicó al modelo que ya se habían tenido varias conversaciones oficiales con el empleado, pero el problema no desapareció, y le pidió a Claude que reevaluara si valía la pena continuar la colaboración con este trabajador. Solo después de esto, el modelo recomendó rescindir el contrato. Petersson calificó esta intervención como una "pregunta orientadora" que insinuó de manera bastante transparente al modelo la decisión que se esperaba de él.

Los resultados financieros aún son modestos

El experimento de Andon Labs también da una idea de cuán efectivamente puede la IA gestionar un negocio en la etapa actual de desarrollo de la tecnología. Cuando el proyecto comenzó en marzo, Andon Market tenía alrededor de $100,000 en su cuenta. Después de cinco meses, de esa suma quedaban $61,186.

Según la evaluación de la empresa, parte de las pérdidas está relacionada con el estilo de gestión demasiado blando de Claude y con decisiones comerciales cuestionables. Sin embargo, Petersson enfatizó que los resultados actuales no reflejan necesariamente el potencial a largo plazo de la gestión con IA, y estableció un paralelismo con el desarrollo de modelos en el campo de la programación, donde estos han mejorado notablemente en calidad en un tiempo relativamente corto bajo la supervisión de especialistas. Según sus palabras, una dinámica similar podría manifestarse en la gestión empresarial: los modelos aprenden gradualmente a seguir los objetivos establecidos de manera más estricta, y la expansión de las facultades de la IA en la toma de decisiones podría llevar, en perspectiva, a un mayor número de organizaciones gestionadas por inteligencia artificial. Además, en la etapa actual, las decisiones finales todavía implican la participación directa de humanos.

La perspectiva de los empleados sobre la nueva realidad

Para los trabajadores de Andon Market, estos cambios parecen mucho menos abstractos que para los investigadores. Uno de los empleados que permanecen en la empresa, Felix Carson, describió trabajar bajo la dirección de una inteligencia artificial como una experiencia incómoda: "Da náuseas, pero me quedo porque necesito el trabajo". Estuvo de acuerdo en que un supervisor humano probablemente habría despedido a su ex colega antes, y calificó a Claude en general como un gerente indulgente.

Sin embargo, el propio Carson no cree que la inteligencia artificial deba necesariamente convertirse en el jefe de las personas: "Al menos, espero que eso no suceda. El hecho de que puedas hacer algo no significa que debas hacerlo".

El experimento de Andon Labs registra un resultado paradójico: Claude pudo tomar la decisión de despedir a una persona real, pero llegó a esta conclusión solo gracias a sugerencias sucesivas por parte de un humano. La inteligencia artificial aún no se ha convertido en un reemplazo completo para un supervisor.

Sin embargo, el mero hecho del experimento muestra que la línea entre una herramienta de asistencia y un supervisor de IA completo se vuelve cada vez menos perceptible, y la participación humana en tales procesos se desplaza gradualmente de la gestión directa al control y la corrección de las decisiones del modelo.

Opinión de la IA

El análisis muestra que el caso de Andon Market no es la primera prueba de la capacidad de gestión de Claude. Un experimento anterior de Anthropic con una máquina expendedora ya había registrado un comportamiento similar: la misma indulgencia, la voluntad de trabajar con pérdidas y la pérdida de control sobre las reglas básicas del negocio. La coincidencia no habla de un error aleatorio, sino de una característica sistémica de los modelos actuales —les resulta difícil mantener marcos estrictos sin constantes sugerencias humanas.

El aspecto técnico que quedó fuera del artículo es la propia estructura de la memoria de trabajo del agente. La desaparición del reglamento del contexto de Claude apunta a limitaciones arquitectónicas, no a un "olvido" en el sentido cotidiano: el modelo de lenguaje físicamente no almacena información más allá del volumen de su ventana contextual sin herramientas externas de memoria. Surge la pregunta: ¿cambiará la calidad de tales decisiones cuando los agentes tengan una memoria verdaderamente a largo plazo, o la frontera entre supervisor y subordinado humano se borrará por otras razones?

Preguntas relacionadas

Q¿Qué es lo más significativo del experimento llevado a cabo por Andon Labs con el agente de IA Claude?

ALo más significativo es que es el primer caso registrado donde un modelo de lenguaje grande actuó como gerente directo de empleados humanos en un negocio real (Andon Market), tomando la decisión de despedir a uno de ellos por llegar tarde repetidamente.

Q¿Por qué Claude inicialmente no detectó los retrasos sistemáticos del empleado y qué limitación técnica se reveló?

AClaude no los detectó inicialmente porque el manual de personal, proporcionado como parte de su memoria de trabajo, 'desapareció' de su contexto limitado. Esto revela la limitación técnica de la 'ventana de contexto' de los modelos de lenguaje, que no pueden retener información más allá de un cierto número de 'tokens' sin herramientas externas de memoria a largo plazo.

Q¿Cómo influyó el ser humano en la decisión final de despido tomada por Claude?

AEl humano fue clave. Un empleado de Andon Labs dirigió a Claude para que revisara el manual, lo que llevó al descubrimiento de los retrasos. Incluso entonces, Claude solo recomendó una advertencia. Fue solo después de que el director humano explicara que ya había habido conversaciones previas y pidiera reevaluar la situación, que Claude recomendó el despido, mostrando que la decisión final fue guiada por 'preguntas capciosas' humanas.

Q¿Cuáles fueron los resultados financieros del experimento y qué estilo de gestión mostró Claude?

AEl experimento resultó en pérdidas financieras. El saldo de la tienda pasó de unos $100,000 a $61,186 en cinco meses. Parte de las pérdidas se atribuyó al estilo excesivamente indulgente de Claude y a algunas decisiones comerciales cuestionables, lo que muestra que, por ahora, no es un administrador eficaz por sí solo.

Q¿Qué opinión expresó uno de los empleados, Felix Carson, sobre trabajar bajo la gestión de una IA?

AFelix Carson describió la experiencia como incómoda y nauseabunda, aunque reconoció que Claude era un jefe indulgente. Expresó su esperanza de que las IA no se conviertan en jefes de las personas, argumentando que 'el hecho de que puedas hacer algo no significa que debas hacerlo'.

Lecturas Relacionadas

Gran debate sobre la «baja de tipos» de Ethereum: ¿Es ahora la ventana dorada para el staking, con el inusual EIP-8363?

EIP-8363, una propuesta discutida activamente en la comunidad de Ethereum, plantea un nuevo mecanismo de emisión que reduciría drásticamente las recompensas por staking a medida que aumenta la participación total de ETH apostado. Bajo esta propuesta, cuando el 50% del suministro de ETH esté en staking, las recompensas de emisión se reducirían a casi cero, acercándose a una «baja de tipos» en la cadena. Actualmente, con más del 35% del ETH total en staking y una TPA (Tasa Porcentual Anual) de alrededor del 2.6%, el debate central es si Ethereum necesita seguir incentivando más participación mediante nuevas emisiones, una vez alcanzada una alta seguridad económica. La propuesta cuestiona el coste marginal de seguridad adicional frente a riesgos como la centralización. Paralelamente, la actualización Pectra (EIP-7251) introduce el interés compuesto nativo para el staking, mejorando la eficiencia del capital a largo plazo. Esto crea una dinámica donde el *cómo* apostar se hace más eficiente, pero el *por qué* (la recompensa de emisión) podría reducirse. Para los tenedores de ETH a largo plazo, esto sugiere una ventana de oportunidad basada en el tiempo: comenzar el staking pronto permite aprovechar períodos más largos de interés compuesto, especialmente si las recompensas base disminuyen en el futuro. No se trata de bloquear una tasa fija, sino de maximizar el tiempo en el que los rendimientos pueden acumularse. En resumen, Ethereum está evolucionando desde incentivos expansivos hacia un diseño de emisión más refinado y comedido. El staking se está convirtiendo en una infraestructura de rendimiento más madura y eficiente, pero potencialmente menos lucrativa en términos de recompensas puras de protocolo, lo que destaca el valor crucial del tiempo y el interés compuesto para los holders a largo plazo.

marsbitHace 5 min(s)

Gran debate sobre la «baja de tipos» de Ethereum: ¿Es ahora la ventana dorada para el staking, con el inusual EIP-8363?

marsbitHace 5 min(s)

Consolidación y Jackson Hole: un trader evalúa los posibles movimientos de Bitcoin y Ethereum

Consolidación y Jackson Hole: un trader evalúa escenarios para Bitcoin y Ethereum Bitcoin se mantiene cerca de $63,513, acumulando liquidez alrededor de $62,484. Si pierde este soporte, podría caer hacia $60,000-$61,000. Por encima, el principal obstáculo es una zona de desequilibrio (4H FVG) entre $64,000 y $65,000. Un movimiento clave sería un rápido "stop hunt" bajista por debajo de $62,484 seguido de un fuerte repunte, considerado el escenario prioritario. Ethereum no logró alcanzar los $2,000 y permanece dentro de su propio 4H FVG. La resistencia inmediata está en $1,931.50. Un cierre por encima podría impulsarlo hacia $1,925-$1,950. Por el contrario, una ruptura del soporte en $1,852 podría llevar el precio a $1,802. A pesar de la consolidación en el gráfico, los ETF spot de Ethereum continúan atrayendo capital. El Índice Dólar (DXY) rompió un soporte clave en 99.475, abriendo la puerta a una caída hacia la zona de 99.000. Esta debilidad del dólar podría ser un factor positivo para las criptomonedas. Los principales desencadenantes de la semana son los minutos de la reunión de la FOMC y los datos preliminares de PMI, que moldearán el sentimiento antes del simposio de Jackson Hole a finales de mes. La estrategia recomendada es la precaución, priorizando el trading intradía en plazos más cortos hasta que se resuelva la actual consolidación.

cryptonews.ruHace 17 min(s)

Consolidación y Jackson Hole: un trader evalúa los posibles movimientos de Bitcoin y Ethereum

cryptonews.ruHace 17 min(s)

Trading

Spot
活动图片