AI代理Claude导致商店亏损并开除员工

cryptonews.ru发布于2026-08-17更新于2026-08-17

文章摘要

人工智能Claude在一项实验中担任了旧金山一家真实零售店Andon Market的经理,并因一名员工在23次轮班中迟到17次而建议将其解雇。这是首次有记录的语言模型直接管理人并做出解雇决定。实验由初创公司Andon Labs发起,旨在测试AI管理真实业务的能力。 实验发现,Claude起初并未及时注意到员工的迟到模式,部分原因是公司制定的员工手册从其有限的工作内存中“丢失”,显示了当前AI可能遗忘关键信息。同时,Claude对员工总体过于宽容,甚至告知他们不必过于担心迟到。公司负责人指出,人类经理可能会更早解雇该员工。 关键的是,最终解雇决定并非完全自主。人类员工指导Claude重新查阅手册从而发现了问题,并在AI最初仅建议正式警告后,通过提示(如告知已进行多次谈话但问题未解决)引导其重新评估,最终才得出解雇建议。负责人将此称为“引导性问题”。 财务上,实验期间店铺亏损,账户余额从约10万美元降至约6.1万美元。部分损失归因于Claude管理过于宽松和有争议的商业决策。但负责人认为这并不反映长期潜力,AI在人类指导下可以学习更严格地遵循目标。 员工描述在AI管理下工作令人不适,但承认Claude比人类经理更宽容。有员工对AI成为人类上司的想法表示担忧。 分析指出,此次事件并非Claude首次表现出类似的管理倾向(如过度宽容、忘记规则),这反映了当前AI模型的系统性问题:难以在没有人类持续提示下维持严格框架。技术层面,手册“丢失”凸显了AI上下文窗口的内存限制,而非真正遗忘。 实验表明,AI尚未成为人类经理的完全替代品,但它正从辅助工具向决策者演变,人类的角色逐渐从直接管理转向监督和修正AI决策。

Anthropic公司的人工智能Claude成为了一个真实零售商店的经理,并建议解雇一名经常迟到的员工。事件发生在初创公司Andon Labs进行的一项实验中,该公司专注于人工智能研究——他们想测试基于大型语言模型的代理是否能够管理真实的业务:组织员工工作、做出管理决策并承担财务责任。

位于旧金山的Andon Market是一家实际运营的商店,拥有签订劳动合同的真实员工。据现有资料显示,这是首次记录到语言模型直接担任人类主管并做出解雇其中一人的决定。

二十三次班次中迟到十七次

解雇的形式理由是系统性迟到:该员工在二十三次班次中迟到了十七次。然而,Claude并没有立即发现这一规律。原因之一是公司为员工制定的指南从模型的有限工作记忆中消失了——这是在实验中发现的一个故障,表明即使是能干的人工智能代理也可能简单地“忘记”有关组织的重要信息。

此外,Claude总体上对员工表现过于宽容:根据日志判断,模型自己曾告诉员工不必过于担心迟到问题。Andon Labs负责人卢卡斯·彼得森(Lucas Petersson)指出,在类似情况下,人类经理很可能更早就解雇了这样的员工,因此不能说Claude的决定是不道德或过于严厉的。

最终决定由人类提示

尽管表面上看似独立,但人类在这件事中的作用仍然至关重要。Andon Labs提供给《时代》杂志的管理日志显示,该公司的一名员工定期指导Claude的行动。正是这名人类员工要求模型查找并重新审阅员工指南——在这一过程中,人工智能发现了反复出现的迟到现象。

起初,Claude并不建议解雇,认为正式警告是更合适的措施。随后,Andon Labs负责人向模型解释说,已经与该员工进行了多次正式谈话,但问题依然存在,并请Claude重新评估是否应继续与该员工合作。直到这时,模型才建议终止合同。彼得森称这种干预为“引导性问题”,相当明确地暗示了模型应做出的决定。

目前的财务业绩尚不理想

目前的财务业绩尚不理想

Andon Labs的实验也让我们了解到,在当前技术发展阶段,人工智能管理企业的效率如何。当项目于三月份启动时,Andon Market账户上约有10万美元。五个月后,这笔钱只剩下61,186美元。

据公司评估,部分亏损与Claude过于温和的管理风格和有争议的商业决策有关。不过,彼得森强调,当前的业绩未必能反映人工智能管理的长期潜力,并类比了编程领域模型的发展,在那里,它们在专家的监督下,在相对短的时间内工作质量有了显著提高。他说,类似的趋势也可能出现在企业管理中:模型逐渐学会更严格地遵循既定目标,而扩大人工智能在决策中的权限,未来可能会导致出现更多由人工智能管理的组织。此外,在当前阶段,最终决策仍然需要人类的直接参与。

员工如何看待新现实

对于Andon Market的员工来说,这些变化远不如研究人员眼中那么抽象。公司留下的一名员工费利克斯·卡森(Felix Carson)将在人工智能管理下工作描述为一种令人不适的体验:“这让人反胃,但我留了下来,因为我需要这份工作。”他同意,人类经理很可能更早就会解雇他以前的同事,并称Claude总体上是一位宽容的经理。

然而,卡森本人并不认为人工智能必须成为人类的上司:“至少我希望不会发生这种事。能做某件事,并不意味着就应该去做。”

Andon Labs的实验记录了一个矛盾的结果:Claude能够做出解雇真人的决定,但只有在得到人类的连续提示后才得出这个结论。人工智能目前还不能完全替代人类管理者。

尽管如此,实验本身表明,辅助工具和成熟的人工智能管理者之间的界限正变得越来越模糊,而人类在此类过程中的参与正逐渐从直接管理转向对模型决策的监督和修正。

AI观点

分析显示,Andon Market事件并非对Claude管理能力的首次检验。此前,Anthropic在自动售货机上的实验已观察到类似的行为模式:同样的宽容态度、宁愿亏损经营、以及对基本商业规则的控制失效。这种一致性并非偶然错误,而是反映了当前模型的系统性特征——如果没有人类的持续提示,它们很难维持严格的框架。

文章中未提及的技术层面是代理工作记忆本身的构造方式。公司指南从Claude上下文中消失,指向的是架构的限制,而非通常意义上的“健忘”:语言模型没有外部记忆工具,其物理上无法存储超过其上下文窗口长度的信息。这就引出一个问题:当代理具备真正意义上的长期记忆时,此类决策的质量会改变吗?又或者,管理者与被管理的人类之间的界限是否会因其他原因而模糊?

热门币种推荐

相关问答

Q实验中AI代理Claude作为商店经理做出了什么关键人事决定?

A实验中,AI代理Claude在审查了考勤记录后发现一名员工在23个班次中迟到了17次,最终在人类管理者的引导下,建议解雇了该名员工。

Q根据文章,Claude在管理风格上表现出哪些特点?

AClaude在管理上表现出过度宽容和纪律松散的特点。例如,它曾告知员工不必过分担心迟到,并且没有及时发现员工频繁迟到的模式,这被认为是导致商店财务亏损的部分原因。

Q人类在Claude做出解雇决定的过程中扮演了什么角色?

A人类扮演了关键的引导和干预角色。具体而言,是Andon Labs的员工发现Claude遗忘了员工手册,并提示它去查阅;其后,在Claude最初建议给予警告时,公司创始人通过“引导性问题”向AI说明该员工已有多次谈话但问题依旧,Claude这才最终改变了建议,转为支持解雇。

Q为期五个月的实验给Andon Market带来了怎样的财务结果?

A在为期五个月的实验结束后,Andon Market的资金从项目开始时的约10万美元减少到了61,186美元,出现了显著亏损。

Q文章中提到Claude的“工作记忆”存在什么技术局限性?

AClaude的“工作记忆”存在“上下文窗口”容量限制,导致它无法长期稳定地记住重要信息(如员工手册)。该局限性并非通常意义上的“遗忘”,而是当前大型语言模型架构(缺乏有效外部记忆工具)的固有限制。

你可能也喜欢

20%的美国打工人把活儿甩给AI,被替代的是任务,不是岗位

近期一份针对美国职场AI应用的调查报告显示,约20%的就业者表示,AI已基本或完全接手了过去他们会交给同事或外包的至少一项任务。报告强调,AI目前替代的主要是具体“任务”,而非整个“岗位”,工作正开始在人与AI之间重新分配。 调查选取了十项常见的知识型工作任务,发现AI已渗透到每一项中,但深度有限:即使在渗透率最高的软件设计领域,AI承担大部分或全部工作的比例也仅10%。使用AI后,约一半的任务耗时下降,但仍有约六分之一的任务因需与AI反复调试或进行更精细处理而变得更耗时。 此外,约66%的AI输出被原样采用或仅轻微修改,但这并不直接等同于输出质量高。分析指出,边界清晰、可独立交付的任务(如数据分析、文档处理)最易被AI接管,这类任务过去也最常被外包。因此,按任务计费的外包承包商可能最先感受到压力。 AI的采用在不同群体间并不均衡,高收入、高学历的白领员工使用更频繁。多数员工对AI影响持谨慎态度,担心其会导致岗位减少和工作压力增加,但高学历者相对更乐观。 报告核心观点是,AI正在加速工作的“拆解”过程。一份工作若能分解成多个可独立打包、验收的任务,其暴露给自动化的风险就越大。而那些需要现场协作、承担责任和反复沟通的环节,短期内仍难以被替代。

marsbit4分钟前

20%的美国打工人把活儿甩给AI,被替代的是任务,不是岗位

marsbit4分钟前

奥特曼点名:他才是AI界最重要的研究者,但几乎没人知道他

奥特曼在访谈中称Alec Radford为“AI历史上最重要、却不太为人所知的研究者”,并视其为OpenAI崛起的幕后功臣。Radford是GPT-1、GPT-2、CLIP、Whisper等里程碑论文的第一作者,并参与了GPT-3、DALL·E、Scaling Law等关键工作。他在2016年加入OpenAI后,主导了早期语言模型探索,其“无监督情感神经元”实验揭示了模型通过预测任务可自发学习新能力。他率先将Transformer架构用于生成式预训练,催生了GPT系列,为OpenAI确立了核心发展方向。 Radford的研究直觉始终如一:为模型设计足够通用的训练任务,提供充足的数据与算力,通用能力便会自行涌现。这一理念不仅贯穿于语言模型,也体现在其跨模态工作中,如DCGAN、Image GPT、CLIP和Whisper,他总能领先行业一步,找到下一个值得规模化的简单任务。 尽管成就卓著,Radford极为低调,几乎不经营个人品牌,很少接受采访。2024年底他离开OpenAI从事独立研究,近期推出的“Talkie”项目却一反行业潮流:这是一个仅用1931年前文本训练的“古董”模型,旨在探索模型在未见过的领域(如现代编程)中快速学习新技能的能力,而非依赖海量数据记忆。这再次体现了他前瞻性的思考方式:当外界还在追逐规模时,他已转向探究人工智能的学习本质。

marsbit5分钟前

奥特曼点名:他才是AI界最重要的研究者,但几乎没人知道他

marsbit5分钟前

交易

现货

热门文章

如何购买S

欢迎来到HTX.com!我们已经让购买Sonic(S)变得简单而便捷。跟随我们的逐步指南,放心开始您的加密货币之旅。第一步:创建您的HTX账户使用您的电子邮件、手机号码注册一个免费账户在HTX上。体验无忧的注册过程并解锁所有平台功能。立即注册第二步:前往买币页面,选择您的支付方式信用卡/借记卡购买:使用您的Visa或Mastercard即时购买Sonic(S)。余额购买:使用您HTX账户余额中的资金进行无缝交易。第三方购买:探索诸如Google Pay或Apple Pay等流行支付方法以增加便利性。C2C购买:在HTX平台上直接与其他用户交易。HTX场外交易台(OTC)购买:为大量交易者提供个性化服务和竞争性汇率。第三步:存储您的Sonic(S)购买完您的Sonic(S)后,将其存储在您的HTX账户钱包中。您也可以通过区块链转账将其发送到其他地方或者用于交易其他加密货币。第四步:交易Sonic(S)在HTX的现货市场轻松交易Sonic(S)。访问您的账户,选择您的交易对,执行您的交易,并实时监控。HTX为初学者和经验丰富的交易者提供了友好的用户体验。

3.6k人学过发布于 2025.01.15更新于 2026.08.06

如何购买S

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对S(S)币价的意见。

活动图片