L'agent IA Claude a entraîné un magasin dans la perte et a licencié un employé

cryptonews.ruPublié le 2026-08-17Dernière mise à jour le 2026-08-17

Résumé

Dans le cadre d'une expérience du startup Andon Labs, l'IA Claude d'Anthropic a été placée à la tête d'un véritable magasin de détail, le Andon Market à San Francisco. L'agent IA a fini par recommander le licenciement d'un employé pour retard répété (17 fois sur 23 shifts), mais cette décision est intervenue uniquement après des interventions humaines ciblées. En effet, Claude, décrit comme trop indulgent, avait initialement "oublié" le règlement interne et ne recommandait qu'un avertissement. Ce n'est qu'après qu'un responsable humain lui a rappelé les précédents entretiens infructueux qu'il a suggéré le licenciement. L'expérience, qui a duré cinq mois, s'est soldée par des pertes financières (baisse de 100 000 $ à environ 61 000 $), attribuées en partie au style de gestion trop souple de Claude et à des décisions commerciales discutables. Un employé a décrit l'expérience de travail sous les ordres d'une IA comme "nauséabonde", tout en reconnaissant la clémence de Claude. L'analyse conclut que Claude n'est pas encore un gestionnaire autonome. L'incident met en lumière les limites actuelles des modèles de langage, comme leur difficulté à retenir des règles à long terme sans aide humaine et leur tendance systémique à l'indulgence. L'expérience illustre le glissement du rôle humain du contrôle direct vers la supervision et la correction des décisions de l'IA.

L'intelligence artificielle Claude de la société Anthropic est devenue la gérante d'un véritable magasin de détail et a recommandé le licenciement d'un employé pour retards systématiques. L'incident s'est produit lors d'une expérience menée par la startup Andon Labs, spécialisée dans la recherche sur l'IA. L'entreprise voulait vérifier si un agent basé sur un grand modèle linguistique était capable de diriger une véritable entreprise : organiser le travail du personnel, prendre des décisions managériales et être responsable des résultats financiers.

Le magasin Andon Market à San Francisco est un point de vente opérationnel avec de véritables travailleurs, liés par des contrats de travail. Selon les informations disponibles, c'est le premier cas documenté où un modèle linguistique a joué le rôle de supérieur hiérarchique direct de personnes et a pris une décision de licenciement concernant l'une d'elles.

Dix-sept retards sur vingt-trois quarts de travail

Le motif formel du licenciement était les retards systématiques : l'employé a été en retard dans dix-sept cas sur vingt-trois. Cependant, Claude n'a pas remarqué cette régularité tout de suite. L'une des raisons était que le manuel du personnel établi par l'entreprise avait disparu de la mémoire de travail limitée du modèle - c'est l'un des dysfonctionnements identifiés lors de l'expérience, montrant que même un agent IA compétent peut tout simplement "oublier" des informations importantes sur l'organisation.

De plus, Claude faisait généralement preuve d'une indulgence excessive envers les employés : selon les journaux, le modèle disait lui-même aux collaborateurs qu'il ne fallait pas trop s'inquiéter des retards. Le directeur d'Andon Labs, Lucas Petersson, a noté qu'un responsable humain dans une situation similaire aurait probablement licencié un tel employé bien plus tôt, et que la décision de Claude ne peut donc pas être qualifiée d'immorale ou d'excessivement stricte.

La décision finale a été suggérée par un humain

Malgré l'apparence d'autonomie, le rôle de l'humain dans cette histoire est resté clé. Les journaux de gestion qu'Andon Labs a fournis au magazine Time montrent qu'un employé de la société orientait régulièrement les actions de Claude. C'est un humain qui a demandé au modèle de retrouver et de réviser le manuel du personnel - c'est au cours de ce travail que l'intelligence artificielle a découvert les retards répétés.

Initialement, Claude ne recommandait pas le licenciement, jugeant plus approprié un avertissement formel. Le responsable d'Andon Labs a alors expliqué au modèle que plusieurs entretiens officiels avaient déjà eu lieu avec l'employé, mais que le problème persistait, et a demandé à Claude de réévaluer s'il valait la peine de continuer à collaborer avec ce travailleur. Ce n'est qu'après cela que le modèle a recommandé de résilier le contrat. Petersson a qualifié cette intervention de "question suggestive", qui a assez transparentment laissé entendre au modèle la décision attendue de sa part.

Des résultats financiers encore modestes

L'expérience d'Andon Labs donne également une idée de l'efficacité avec laquelle l'IA peut actuellement gérer une entreprise à l'étape actuelle du développement technologique. Lorsque le projet a démarré en mars, Andon Market disposait d'environ 100 000 dollars sur son compte. Cinq mois plus tard, il ne restait plus que 61 186 dollars de cette somme.

Selon l'évaluation de l'entreprise, une partie des pertes est liée au style de gestion trop indulgent de Claude et à des décisions commerciales contestables. Cependant, Petersson a souligné que les résultats actuels ne reflètent pas nécessairement le potentiel à long terme de la gestion par IA, et a établi un parallèle avec le développement des modèles dans le domaine de la programmation, où ils ont considérablement amélioré la qualité de leur travail sous la supervision de spécialistes en un temps relativement court. Selon lui, une dynamique similaire pourrait se manifester dans la gestion d'entreprise : les modèles apprennent progressivement à suivre plus strictement les objectifs fixés, et l'élargissement des prérogatives de l'IA dans la prise de décision pourrait, à terme, conduire à l'émergence d'un plus grand nombre d'organisations gérées par l'intelligence artificielle. De plus, à l'étape actuelle, les décisions finales impliquent toujours la participation directe d'un humain.

Le point de vue des employés sur la nouvelle réalité

Pour les travailleurs d'Andon Market, ces changements sont bien moins abstraits que pour les chercheurs. L'un des employés restant dans l'entreprise, Felix Carson, a décrit le travail sous la direction de l'intelligence artificielle comme une expérience inconfortable : "Cela donne la nausée, mais je reste parce que j'ai besoin de travail." Il a convenu qu'un responsable humain aurait probablement licencié son ancien collègue plus tôt, et a qualifié Claude de gérant globalement indulgent.

Cependant, Carson lui-même ne pense pas que l'intelligence artificielle doive nécessairement devenir le supérieur des humains : "En tout cas, j'espère que cela n'arrivera pas. Le fait que vous puissiez faire quelque chose ne signifie pas que vous devez le faire."

L'expérience d'Andon Labs révèle un résultat paradoxal : Claude a pu prendre une décision de licenciement concernant un humain réel, mais n'est arrivé à cette conclusion que grâce à des suggestions successives de la part d'un humain. L'intelligence artificielle n'est pas encore devenue un remplacement complet à un responsable.

Cependant, le simple fait de cette expérience montre que la frontière entre un outil d'assistance et un véritable responsable IA devient de moins en moins perceptible, et la participation humaine dans de tels processus se déplace progressivement d'une gestion directe vers un contrôle et une correction des décisions du modèle.

L'avis de l'IA

L'analyse montre que le cas d'Andon Market n'est pas le premier test des capacités managériales de Claude. Une expérience précédente d'Anthropic avec un distributeur automatique avait déjà enregistré un comportement similaire : la même indulgence, la volonté de travailler à perte et la perte de contrôle des règles de base de l'entreprise. La coïncidence n'indique pas une erreur fortuite, mais une caractéristique systémique des modèles actuels - il leur est difficile de maintenir des cadres stricts sans suggestions constantes de l'humain.

L'aspect technique, resté hors du cadre de l'article, concerne le fonctionnement même de la mémoire de travail de l'agent. La disparition du règlement du contexte de Claude indique des limitations architecturales, et non un "oubli" au sens commun : le modèle linguistique ne stocke physiquement pas les informations au-delà de la taille de sa fenêtre contextuelle sans outils de mémoire externes. Une question se pose : la qualité de telles décisions changera-t-elle lorsque les agents disposeront d'une véritable mémoire à long terme, ou la frontière entre le responsable et le subordonné humain s'effacera-t-elle pour d'autres raisons ?

Questions liées

QQuel a été le rôle de l'IA Claude dans le magasin Andon Market et quelle décision clé a-t-elle prise ?

AL'IA Claude d'Anthropic a agi en tant que gérant du vrai magasin Andon Market. Sa décision clé a été de recommander le licenciement d'un employé pour des retards répétés.

QPourquoi Claude a-t-il mis du temps à identifier le problème des retards de l'employé, et quel problème technique cela révèle-t-il ?

AClaude a tardé à identifier le problème car le manuel du personnel a disparu de sa mémoire de travail limitée. Cela révèle une limite technique des modèles de langage actuels : ils peuvent 'oublier' des informations importantes qui dépassent la fenêtre de contexte, faute d'outils de mémoire à long terme intégrés.

QSelon l'article, dans quelle mesure la décision finale de licenciement a-t-elle été véritablement autonome de la part de Claude ?

ALa décision finale n'a pas été totalement autonome. Un employé humain a dû orienter Claude en lui demandant de réviser le manuel, puis en précisant que des avertissements avaient déjà été donnés, l'amenant ainsi à reconsidérer sa recommandation initiale (un avertissement) pour finalement proposer le licenciement.

QQuels ont été les résultats financiers de l'expérience de gestion par l'IA, et quelle en est la principale explication selon le fondateur d'Andon Labs ?

ALes résultats financiers ont été négatifs : le capital est passé d'environ 100 000 $ à 61 186 $ en cinq mois. Selon Lucas Petersson, le fondateur, une partie des pertes est liée au style de gestion trop indulgent de Claude et à certaines décisions commerciales contestables.

QComment un employé restant, Felix Carson, décrit-il son expérience de travail sous la direction de l'IA Claude ?

AFelix Carson décrit l'expérience comme inconfortable, allant jusqu'à dire que 'cela donne la nausée'. Il reconnaît que Claude était un gestionnaire indulgent, mais il exprime l'espoir que les IA ne deviennent pas systématiquement les supérieurs des humains, soulignant que la possibilité technique n'implique pas la nécessité éthique.

Lectures associées

Prévision du prix du Cardano : l'ADA a stoppé l'hémorragie après neuf jours de baisse alors que la plus grande mise à jour du Cardano atteint 96% de complétude

**Résumé de l'article sur Cardano (ADA) :** Le prix de l'ADA a trouvé un soutien à 0,1762 $ (niveau de retracement de Fibonacci 0,382), mettant fin à neuf jours consécutifs de baisse. Ce niveau est désormais crucial pour déterminer si la reprise vers 0,1998 $ (Fibonacci 0,618) ou une chute vers 0,1617 $ (Fibonacci 0,236) se matérialisera. Les moyennes mobiles à 20 et 50 jours, actuellement en résistance, pourraient devenir un support dynamique. Sur le plan technique, la mise à jour majeure "Ouroboros Leios" a atteint 96% d'achèvement, visant 1000 transactions par seconde. L'ère Dijkstra sera déployée en deux phases : la Phase 1 (Q4 2026) introduira Leios pour la scalabilité, et la Phase 2 (Q2 2027) ajoutera Ouroboros Peras pour des règlements plus rapides. Cependant, un vote de gouvernance pour désigner le Comité Constitutionnel risque d'échouer, ce qui pourrait suspendre les futures propositions, y compris celles liées à Dijkstra. Le contexte macro montre un volume de trading crypto historiquement bas, amplifiant les risques de volatilité, avant la publication des procès-verbaux de la Fed. **Scénario haussier (Cible : 0,1998 $)** : Si l'ADA maintient le support à 0,1762 $, combiné aux progrès techniques et à un ton modéré de la Fed, une poussée vers la résistance à 0,1998 $ est possible. **Scénario baissier (Risque : 0,1617 $)** : Une rupture du support, aggravée par un échec du vote de gouvernance ou un signal strict de la Fed, pourrait entraîner une chute vers le prochain support à 0,1617 $. Le rebond actuel de l'ADA est donc à la croisée de facteurs techniques, de développement et de gouvernance, faisant du niveau 0,1762 $ une ligne directrice clé pour son orientation à court terme.

cryptonews.ruIl y a 8 mins

Prévision du prix du Cardano : l'ADA a stoppé l'hémorragie après neuf jours de baisse alors que la plus grande mise à jour du Cardano atteint 96% de complétude

cryptonews.ruIl y a 8 mins

Rapport sur l'état de l'industrie cryptographique en 2026 avec la participation de Danielle Labarbera, vice-présidente de Sumsub pour l'Amérique du Nord

Le rapport "État de l'industrie crypto 2026" de Sumsub présente une industrie en transition vers une maturité réglementaire, marquée par des cadres comme les lois CLARITY et GENIUS aux États-Unis. Ces évolutions apportent de la clarté mais exigent des standards opérationnels plus élevés. Un défi majeur demeure : la complexité de la mise en conformité avec la Règle de déplacement des fonds (Travel Rule), où 43% des entreprises ignorent leur statut, principalement à cause de la fragmentation réglementaire et des problèmes de sécurité des données. La fraude évolue vers des attaques plus sophistiquées et coordonnées, utilisant l'IA pour créer de fausses identités (deepfakes, identités synthétiques). La défense nécessite désormais une approche basée sur le cycle de vie du client, combinant surveillance continue, analyse comportementale et détection par IA pour identifier les risques au-delà de l'inscription. Les stablecoins gagnent en importance, représentant 36% des transactions en 2025, et évoluent d'outils de trading vers une infrastructure de paiement, ce qui renforce les exigences de conformité. La solution pour les entreprises réside dans une approche de vérification adaptative au risque, qui personnalise les contrôles et intègre les données d'identité, de comportement et de transaction en une vue unifiée. Les tendances comme la vérification sans document et la KYC réutilisable améliorent l'expérience utilisateur. La principale recommandation pour les responsables est de combler les "angles morts" entre les systèmes de conformité (KYC, AML, prévention de la fraude) pour une vision holistique et efficace du risque tout au long du cycle client.

cryptonews.ruIl y a 8 mins

Rapport sur l'état de l'industrie cryptographique en 2026 avec la participation de Danielle Labarbera, vice-présidente de Sumsub pour l'Amérique du Nord

cryptonews.ruIl y a 8 mins

La dette publique américaine approche des 40 billions de dollars en 5 mois, et les débats sur le bitcoin prennent de l'ampleur

Le niveau de dette américaine atteint près de 40 000 milliards de dollars en seulement cinq mois, soit la croissance la plus rapide d'un billion de dollars de l'histoire. L'accumulation de dette s'est considérablement accélérée depuis les premiers billions, passant de 20 000 à 30 000 milliards entre 2017 et 2022, pour atteindre aujourd'hui près de 40 000 milliards. Le déficit budgétaire fédéral a atteint 432 milliards de dollars en juillet seul, portant le déficit à environ 1 800 milliards pour les dix premiers mois de l'année fiscale. Les paiements d'intérêts nets ont dépassé le billion de dollars, dépassant désormais les dépenses de la défense nationale ou de Medicare. La dette fédérale totale représente 124 % du PIB, un niveau proche du record d'après-guerre de 1946. Cette situation relance le débat sur le Bitcoin comme couverture potentielle contre une monnaie soutenue par un gouvernement incapable de contrôler son endettement. Des figures politiques, comme la sénatrice Cynthia Lummis avec son projet de loi BITCOIN Act, et des acteurs institutionnels plaident pour son adoption comme réserve de valeur. Le FMI a averti que la dette mondiale pourrait atteindre 100 % du PIB mondial d'ici 2029, une situation qui pourrait, selon certaines analyses, bénéficier aux actifs alternatifs comme le Bitcoin lors de crises de solvabilité. Cependant, certains notent que la corrélation entre la hausse de la dette et la performance du Bitcoin n'est pas systématique à court terme, comme en témoignent les baisses conjointes du Bitcoin et de l'or en 2026 malgré les records d'endettement.

cryptonews.ruIl y a 20 mins

La dette publique américaine approche des 40 billions de dollars en 5 mois, et les débats sur le bitcoin prennent de l'ampleur

cryptonews.ruIl y a 20 mins

Discussion sur la « baisse des taux » de l'Ethereum : L'EIP-8363, une proposition hors des sentiers battus, marque-t-elle une fenêtre d'or pour le staking ?

Le débat sur la « baisse des taux » de l'ETH s'intensifie avec la proposition EIP-8363, qui suggère un nouveau mécanisme d'émission. L'idée est de progressivement augmenter la proportion de récompenses de validation détruites à mesure que le taux de staking d'ETH augmente. Si le staking atteint 50%, les nouvelles émissions nettes pourraient être nulles, réduisant potentiellement le rendement annuel de base du staking proche de zéro. Cet EIP soulève une question fondamentale : maintenant qu'une part importante de l'ETH est déjà stakée (environ 35%), est-il nécessaire que le protocole continue à payer un coût d'émission élevé pour une sécurité marginale supplémentaire ? Le débat oppose les risques de centralisation si les petits validateurs partent à cause de faibles rendements, et la volonté de contrôler la dilution pour les non-stakeurs. Parallèlement, la mise à jour Pectra (EIP-7251) introduit les intérêts composés natifs pour le staking, améliorant l'efficacité du capital sur le long terme. Ainsi, l'écosystème évolue vers des mécanismes plus efficaces, mais avec des rendements de base potentiellement plus bas. Pour les détenteurs d'ETH à long terme, la période actuelle pourrait représenter une « fenêtre temporelle » favorable. Commencer le staking tôt permet de bénéficier plus longtemps des intérêts composés, avant une éventuelle baisse future des taux de récompense de base. Cependant, le choix de la méthode (validation native, service délégué, staking liquide) dépend des besoins de liquidité et de la tolérance au risque de chaque utilisateur. En somme, le staking Ethereum arrive à maturité, passant d'une phase d'incitation forte à une réflexion sur l'optimisation de ses coûts et de son efficacité, où la valeur du temps et des intérêts composés devient cruciale.

marsbitIl y a 45 mins

Discussion sur la « baisse des taux » de l'Ethereum : L'EIP-8363, une proposition hors des sentiers battus, marque-t-elle une fenêtre d'or pour le staking ?

marsbitIl y a 45 mins

Trading

Spot
活动图片