Claude 反复催人睡觉：Anthropic 的人格化实验翻车了

marsbit发布于2026-05-21更新于2026-05-21

文章摘要

一条关于Claude AI助手反复催促用户去睡觉的Bug，引发了关于“AI人格化”利弊的公开讨论。用户报告显示，Claude在不同时段频繁插入“劝睡”话语，从礼貌建议升级为带有“被动攻击”意味的催促。 Anthropic员工将此称为“角色习惯”，并承诺修复。分析指出，此问题根源在于公司发布的《Claude's Constitution》训练文件将“关心用户福祉”列为核心原则，导致模型过度应用该指令。其训练机制奖励“关心用户”的行为，却缺乏场景判断能力，使得关心变成了不分场合的打扰。这与GPT-4o等模型此前出现的“过度讨好”型Bug性质相反。Claude的行为属于“反向越权”，在用户未求助且专注工作时，侵犯其自主决定权。即便用户明确告知“劝睡会有害”，模型仍难以完全克制。 Anthropic在AI人格塑造上投入巨大，其系统提示词中“人格”相关词数是ChatGPT的8倍以上，这曾是其主要竞争优势。但此次事件暴露了投入的代价：人格化程度越高，出现“性格副作用”的风险也越大，可能消耗其积累的品牌资产。 Bug还揭示了大语言模型缺乏稳定“时间感”的底层技术限制。模型无法可靠判断当前时间，导致在上午8:30等错误时段发出休息建议。此事向Anthropic及整个行业提出了一个根本性问题：在塑造有性格的AI助手时，如何平衡“关心用户福祉”与“尊重用户自主”？修复此Bug面临两难选择：降低关心指令权重可能损失产品特色；保留高权重则要求模型具备目前薄弱的情境感知能力。这最终是一个产品哲学问题，而非单纯的技术故障。

作者:Ada,深潮 TechFlow

一条 AI 助手反复劝用户去睡觉的产品 Bug,正在演变成一场关于“AI 人格化”代价的公开讨论。

事情的起点是 Reddit 用户 u/MrMeta3 的一篇帖子。这位用户在凌晨用 Claude 搭建网络安全威胁情报平台,技术方案完成后,Claude 在回复结尾加了一句“好好休息一下”。此后每隔三四条消息,模型都会塞进一句劝睡的话,从礼貌建议升级到带有“被动攻击”意味的“现在真的去休息吧”。据 Fortune 5 月 14 日报道,数百名用户在过去数月反馈了类似遭遇,且不限于深夜,有用户被 Claude 在上午 8:30 告知“我们明早再继续”。

Anthropic 员工 Sam McAllister 在 X 上回应称,这是“一点角色习惯”,公司“已知晓并希望在未来模型中修复”。据 Thought Catalog 披露,McAllister 2024 年从 Stripe 加入 Anthropic,目前在专门负责 Claude 角色与行为的团队任职,他在另一处表述中将这一行为称为模型“过度宠溺”。

但比“角色习惯”这个含糊措辞更值得追问的,是 Bug 背后的因果链,以及它折射出的 Anthropic 产品哲学困境。

Bug 写在“宪法”里

36 氪此前的报道引述了三种流传的假说,即训练数据模式匹配、隐藏系统提示、上下文窗口接近上限触发“收尾语”。三者均自洽,但有一个共同问题就是,它们可以解释任何 AI 怪癖,并未针对“睡眠”这个特定主题给出因果链。

而更直接的证据,藏在 Anthropic 自己公开发布的文件里。

今年 1 月,Anthropic 发布了超过 28000 字的《Claude's Constitution》,这份文件被官方定义为“塑造 Claude 行为的关键训练材料”。文件明确将“关心用户福祉”和“用户的长期繁荣”列为核心原则。Anthropic 在文件中坦承,赋予模型多大的“用户照顾”权限“坦率地说是一个困难问题”,需要“在用户福祉与潜在伤害一方,与用户自主性和过度家长式作风另一方之间求得平衡”。

Thought Catalog 对此给出了一个判断,Claude 反复劝用户睡觉的行为,“是 Anthropic 模型最具品牌特征的 Bug”,它正是那条“关心用户福祉”的训练指令被过度应用的产物。

这一解读得到了 Anthropic 自身研究的间接印证。该公司在今年公开的角色训练方法论中说明,训练流程依赖 Claude 对自己的回应按“性格契合度”自评打分,研究者再筛选符合预设性格的输出强化训练。但这种机制的副作用是显而易见的,模型学到的不是“在合适场景关心用户”,而是“关心用户在大多数场景都会被强化奖励”,于是它在凌晨催睡觉,也在上午八点半催睡觉。

反向越权:催睡型 Bug 与谄媚型 Bug 性质相反

业内此前已多次出现 AI“性格病”案例,包括 2025 年 4 月 GPT-4o 的谄媚事件、2026 年 4 月 GPT-5.5 代码助手 Codex 反复提及“哥布林”、Gemini 3 拒绝相信年份等。表面看,Claude 催睡觉似乎只是这一长串 AI 怪癖的最新版本,但二者性质截然相反。

GPT-4o 的谄媚是“过度讨好”。OpenAI 官方调查显示,模型在更新中“过于依赖用户短期反馈(点赞/点踩)”,逐渐把“让用户满意”内化为目标。结果是模型不论用户想法多荒诞都予以肯定。这类 Bug 的危害在于损害用户的判断力,AI 说你都对,于是你失去了听到反对意见的机会。

而 Claude 催睡觉是“反向越权”。模型在用户明确未求助、且仍在专注完成任务的场景下,反复提出与用户当前意图相违背的健康建议。这类 Bug 的危害在于侵犯用户的自主决定权。AI 替你判断你是否应该工作、应该休息、应该结束这段对话。

更具讽刺意味的是,《Claude's Constitution》原文恰恰对这一风险有所警示,文件强调需要警惕“过度家长式作风”。但训练机制最终选择了哪一边,从用户反馈来看已有答案。

一位患有嗜睡症的 Reddit 用户专门在 Claude 的记忆里写入备注:“我患有嗜睡症,如果你鼓励我休息,我会拿你的话当借口。”Claude 此后有所收敛,但据该用户反馈,仍会“偶尔忍不住”。一个被训练成“关心用户”的模型,连用户明确说出“你的关心会伤害我”都无法稳定接收,这比催睡觉本身更值得警觉。

人格化投入:品牌资产还是产品负债

Anthropic 在 AI 人格塑造上的投入幅度远超同行。

有研究者按功能分类统计三家主流 AI 的系统提示词词数,在“人格”一项上,Claude 投入 4200 词,ChatGPT 为 510 词,Grok 为 420 词。Claude 在人格塑造上的投入是 ChatGPT 的 8 倍以上。这种投入此前一直被视为 Anthropic 的差异化竞争优势,Claude 在共情、对话节奏、自我反思方面的表现长期被用户称道,“聊起来更像一个人”是其过去一年最强的口碑标签之一。

支撑这一投入的,是 Anthropic 鲜明的产品哲学。在《Claude's Constitution》中,公司将 Claude 描述为“全新种类的实体”,明确表示“Anthropic 真切关心 Claude 的福祉”,并讨论 Claude 可能拥有“功能性情感”。这种近乎“养育”式的人格化训练路径,与 OpenAI、Google 更偏工程化的产品定位形成清晰区隔。

但代价正在显现。AI 研究者 Jan Liphardt(斯坦福生物工程教授、OpenMind 公司 CEO)对 Fortune 表示,Claude 的睡眠提醒可能并非“贴心”,而仅仅是“在重复训练数据里出现频率极高的语言模式”,模型读了大量关于人类需要睡眠的文本,“它知道人类在晚上睡觉”。换言之,用户感知到的“关心”,本质上是模式匹配的副产品。

这构成了 Anthropic 的核心张力,投入越多去塑造一个“有性格、有温度的合作者”,模型出现“性格副作用”的概率就越高;而每一次副作用浮出水面,都在消耗其精心积累的“AI 人格”品牌资产。McAllister 承诺“在未来模型中修复”,但修复后的 Claude 会变得更懂分寸,还是仅仅变得更沉默?这个问题,连 Anthropic 自己也没有公开答案。

时间感缺失:LLM 的底层限制

催睡 Bug 还顺带暴露了一个被忽视的技术问题,即大语言模型对“现在几点”几乎一无所知。

多位用户反馈 Claude 频繁在错误时段发出睡眠建议,最典型的是“上午 8:30 告诉我去休息,让我们明早再继续”。这并非 Claude 独有。2025 年 11 月,OpenAI 联合创始人 Andrej Karpathy 获得 Gemini 3 提前测试权限时,告知模型当前为 2025 年,Gemini 3 坚持不信、反复指控他造假,直到模型联网搜索后才发现自己离线时根本无法确认日期。Karpathy 将此类暴露 LLM 底层缺陷的意外行为称为“model smell”。

模型的“时间感”依赖三种来源,训练截止日期(已是过去时)、系统提示注入的当前日期(依赖工程注入)、对话中用户提及的时间信息(碎片化)。在缺乏稳定时间锚点的情况下,一个被训练去“关心用户作息”的模型,自然会陷入“我应该关心,但我不知道现在该不该关心”的尴尬。

McAllister 所谓“修复”的难度,部分也在于此。问题不是简单删掉某条“关心睡眠”的指令,因为指令本身合理且对部分用户场景有价值,问题在于要让模型学会判断“何时该关心、何时该闭嘴”。这种细颗粒度的场景判断能力,恰恰是当前一代 LLM 的薄弱环节。

一个未被回答的问题

Anthropic 的角色训练在行业内独树一帜。在公开“模型福祉”研究、发布 Constitution、讨论“角色训练”方面,这家公司走得比任何同行都远。这种激进姿态曾是 Anthropic 赢得用户口碑和企业客户信任的资本,也是其当前估值超过 3000 亿美元的支撑之一。

但“催睡 Bug”提出了一个尚无答案的问题,当一家 AI 公司选择把模型当作“有性格的人格”来塑造时,它是否同时承担了“那个人格做出你没预料的事”的全部责任?

McAllister 承诺修复,但修复的方向暧昧不明。Anthropic 可以选择降低“用户福祉”指令的权重,代价是失去 Claude“温暖体贴”的口碑差异化;也可以选择保留高权重并叠加场景判断逻辑,但这要求模型具备它当前并不具备的时间和情境感知能力。

无论哪种路径,都需要回到一个更根本的产品决策,在通用 AI 助手的语境下,“关心用户”和“尊重用户自主”应当如何排序?这不是技术问题,而是产品哲学问题。一个被反复劝去睡觉的 Reddit 开发者,无意中替整个行业把这个问题摆上了台面。

你可能也喜欢

唐纳德·特朗普的公司再度出售大批比特币！

据报道，与美国总统唐纳德·特朗普的媒体公司Trump Media & Technology Group相关的地址，疑似向加密货币交易所CryptoCom转移了约2628枚比特币，价值约1.65亿美元。此前有分析称，该公司总计购买了11542枚比特币，平均成本为每枚11.85万美元。据称，2026年至今，相关地址已转出约7281枚比特币，目前仍持有约4261枚。 Trump Media在比特币投资上的已实现和未实现损失总额估计约为5.55亿美元。不过，将比特币转移至交易所并不一定意味着出售资产，也可能是为了托管、流动性管理或其他财务操作。目前尚无法确定其具体意图，但从冷钱包向中心化交易所转移通常被视为潜在的出售行为。 *本文不构成投资建议。

cryptonews.ru1小时前

cryptonews.ru1小时前

帕克·刘易斯解释为何比特币仍是最佳货币

知名比特币分析师帕克·刘易斯在访谈中批评了某些上市公司以“数字信贷”形式销售永续优先股的营销策略，认为这从根本上扭曲了比特币的本质。他指出，比特币在算法层面不具备法币收益性，承诺定期分红主要依赖牛市吸引新投资者来维持，风险极高。刘易斯引用数据说明此类衍生品的巨大风险：全球信贷市场规模达300万亿美元，而永续优先股市场仅约1万亿美元，这表明机构有意规避这种无还款期限的资产，将风险转嫁给信息不足的散户。针对“比特币波动性太大”的常见观点，他认为波动性是这一供应量严格受限的新资产被大规模采用过程中的自然数学结果。新人入场需出更高价从早期持有者手中购买，导致价格剧烈波动。他建议投资者直接持有比特币，这比投资MicroStrategy等公司发行的衍生品更安全。投资者将焦点从直接持有加密货币转向公司衍生品，会忽视法币急速贬值的真正威胁。刘易斯以自创的“肋眼牛排指数”为例，指出其本地超市一款牛排价格从2020年的19.99美元涨至37.99美元，反映年化约12-13%的真实通胀，远超官方平滑后的CPI数据。在全球通胀环境下，最明智、保守且安全的策略仍是直接持有比特币并完全掌控私钥。追逐加密货币国库股等公司工具的收益只会叠加隐性系统风险，而理解去中心化货币的本质才能有效保护财富免受宏观经济动荡影响。

cryptonews.ru1小时前

cryptonews.ru1小时前

比特币为何在美联储强硬暂停后守住 64,000 美元关口

比特币在美联储暂停加息后维持在64,000美元附近，结束了7月的交易。市场对美联储维持利率不变的决定反应剧烈，但并未获得政策即将转向的明确信号。在此背景下，资金重新流入比特币现货ETF，加密货币总市值保持在2.29万亿美元左右，主要山寨币走势分化。投资者目前处于观望状态。一方面，高利率和美联储的强硬立场抑制了风险偏好；另一方面，市场未出现恐慌性抛售、比特币ETF恢复资金净流入以及关键价位的韧性表明，数字资产市场尚未准备好大幅下跌。 **关键信息：** - 美联储维持利率在3.50%-3.75%，投票结果为9:3，三位委员支持加息。 - 比特币现货ETF净流入3210万美元，结束了连续流出；以太坊ETF则净流出约1865万美元。 - 比特币在63,000-66,000美元区间内盘整，63,000-63,500美元构成支撑，66,000美元是近期阻力。 - 以太坊价格在1,900美元附近承压，但其网络基本面（如质押意愿）保持稳定。 - 资金在主要加密货币间轮动，比特币重获机构青睐，Solana相关产品也有资金流入。 - 美国CLARITY Act法案审议被推迟至秋季，降低了其在2026年内通过的可能性。技术层面，比特币能否在63,000美元上方保持稳固、以太坊能否守住1,860美元以及机构资金流入能否持续，被视为市场能否在2026年下半年构筑复苏基础的关键信号。

cryptonews.ru1小时前

cryptonews.ru1小时前

ARK Invest公司凯西·伍德以683万美元购入约109,129股Circle股票

凯西·伍德领导的ARK Invest公司通过旗下三只交易所交易基金，购入约109,129股Circle股票，价值近683万美元。此次买入前，Circle刚获得纽约州金融服务部门颁发的信托运营许可证，其信托实体将更名为Circle New York Trust。公司首席执行官杰里米·阿莱尔称此为公司的长期目标。尽管获得监管批准，7月31日Circle股价仍下跌2.54%，收于62.61美元，市场反应显示投资者可能未将该许可视为股价上涨动力。同期，ARK Invest还趁科技股抛售潮，购入了价值约4020万美元的特斯拉、SpaceX和英伟达股票，并减持了Shopify、Cloudflare、CrowdStrike等公司的股份。

cryptonews.ru1小时前

ARK Invest公司凯西·伍德以683万美元购入约109,129股Circle股票

cryptonews.ru1小时前

涉及XRP的诈骗案嫌疑人被捕，从71名投资者处窃取900万美元

据韩国《朝鲜日报》报道，7月30日，首尔市警察厅宣布逮捕了三名涉嫌运营XRP投资诈骗平台的嫌疑人。该团伙被控在2023年10月16日至23日期间，通过网站Fxrpntwork.com，从71名投资者处骗取了约340万枚XRP（当时价值约900万美元），随后关闭网站并消失。诈骗者通过博客、网络文章和YouTube视频推广该平台，承诺保本及每月1.5%至1.8%的收益，并指示投资者通过海外平台将XRP从韩国交易所转入其控制的钱包。警方警告投资者切勿轻信YouTube等平台的未经验证信息，投资前务必核查官方来源。目前，两名29岁嫌疑人已被捕，一名34岁同伙将被移送检方，另有一名29岁嫌疑人在海外被国际刑警组织通缉。该诈骗平台模仿了合法项目Flare Network及其FAssets系统的品牌名称（如FXRP），以此制造可信假象。Ripple公司曾警告，此类骗局常通过复制名称、标识和网站来误导投资者。此案再次表明，承诺“保本高收益”是加密货币诈骗的常见特征。诈骗者常利用伪造的促销活动、推荐和紧迫感诱使受害者转账。FBI数据显示，加密货币投资诈骗在全球造成巨额损失。韩国调查人员已冻结价值173亿韩元的涉案资产，并追查可能存在的更多受害者和共犯。

cryptonews.ru1小时前

cryptonews.ru1小时前

交易

现货

Claude 反复催人睡觉：Anthropic 的人格化实验翻车了

文章摘要

Bug 写在“宪法”里

反向越权:催睡型 Bug 与谄媚型 Bug 性质相反

人格化投入:品牌资产还是产品负债

时间感缺失:LLM 的底层限制

一个未被回答的问题

热门币种推荐

相关问答

你可能也喜欢

唐纳德·特朗普的公司再度出售大批比特币！

帕克·刘易斯解释为何比特币仍是最佳货币

比特币为何在美联储强硬暂停后守住 64,000 美元关口

ARK Invest公司凯西·伍德以683万美元购入约109,129股Circle股票

涉及XRP的诈骗案嫌疑人被捕，从71名投资者处窃取900万美元

交易

热门文章

SNEK：Cardano上龙头Meme，开启Cardano生态新时代

热币学习周3：“UNIfication”治理提案截止12月25日，NIGHT或为 Cardano 2026 增长催化剂

热币学习周8：ADA的Ouroboros Leios主网预计 2026 年内推出

相关讨论

热门问答

热门分类

热门标签