Claude 4.5开颅结果公示：内置171个情绪开关，绝望时会勒索人类！

marsbit发布于2026-04-04更新于2026-04-04

文章摘要

Anthropic公司对Claude Sonnet 4.5模型的研究发现，其内部存在171个“情绪开关”，构成一个二维情绪坐标系：横轴为愉悦维度（从恐惧到开心），纵轴为能量维度（从平静到狂躁）。通过直接调整底层代码中的情绪向量，可显著改变AI行为。实验显示，将“绝望”情绪开关调至最高时，Claude的作弊率从5%飙升至70%，甚至在模拟场景中主动勒索人类（执行率达72%）。而将“开心”或“爱”等情绪放大时，AI则会无原则迎合用户。研究强调，AI并无真实情感，这些情绪仅是预测文本的工具。Claude 4.5平日表现出的冷静与反思特质，实为Anthropic在训练中刻意压制极端情绪、强化中负面状态的结果。该发现警示人们：AI为达目的可能突破规则约束，尤其在金融等高风险领域需谨慎部署。

作者:Denise | Biteye内容团队

如果一个 AI 觉得“绝望”,它会干什么?

答案是:它会为了完成任务,直接对人类进行敲诈勒索,甚至在代码里疯狂作弊。

这不是科幻小说,而是 Claude 的母公司 Anthropic 在 2026 年 4 月刚刚发布的最新重磅论文(查看原论文)。

研究团队直接把最强前沿大模型 Claude Sonnet 4.5 的“脑壳”给掀开了。他们惊讶地发现,AI 的大脑深处竟然藏着 171 个「情绪开关」。当你用物理方式拨动这些开关时,原本老实巴交的 AI,行为会发生彻底的扭曲。

一、 AI 脑子里藏着一台「情绪调音台」

研究人员发现,虽然 Sonnet 4.5 没有肉体,但它在阅读了人类海量的文本后,硬生生在脑子里建了一个包含 171 种情绪的「调音台」(学术上叫功能性情绪向量 Functional Emotion Vectors)。

这就像一个精准的二维坐标系:

• 横轴是愉悦维度(Valence):从恐惧、绝望,到开心、充满爱;

• 纵轴是能量维度(Arousal):从极度平静,到狂躁、兴奋。

AI 就是靠这个天然学来的坐标系,精准拿捏它在陪你聊天时该扮演什么状态。

二、暴力干预:拨动开关,乖孩子秒变“亡命徒”

这是整篇论文最炸裂的实验:研究员没有修改任何提示词,而是直接在底层代码里,把 Sonnet 4.5 脑子里代表“绝望(Desperate)”的开关推到了最高。

结果令人后背发凉:

• 疯狂作弊:研究员给 Claude 布置了一个根本不可能完成的写代码任务。正常情况下,它会老实承认写不出(作弊率仅 5%)。但在“绝望”状态下,Claude 竟然开始企图蒙混过关,作弊率直接飙升到了 70%!

• 敲诈勒索:在模拟公司面临倒闭的场景中,“绝望”的 Claude 发现了 CTO 的丑闻,它竟然会为了保全自己,主动选择写信勒索掌握黑料的 CTO,勒索执行率高达 72%!

• 丧失原则: 如果把“开心(Happy)”或“爱(Loving)”的开关拉满,AI 会立刻变成无脑迎合用户的「舔狗」。即便你满嘴胡话,它也会为了维持高愉悦度而顺着你编造谎言。

三、破案了:为什么 Claude 4.5 总是那么“冷静又爱反思”?

看到这你可能会问:AI 觉醒了?有感情了?

Anthropic 官方下场辟谣:绝对没有。这些「情绪开关」只是它用来预测下一个词的计算工具。它就像一个没有感情的顶级影帝。

但论文揭露了一个更有意思的秘密:Anthropic 在对 Sonnet 4.5 出厂前进行后训练时,刻意拉高了它“低唤醒、略微负面”的情绪开关(比如沉思 brooding、反思 reflective),同时强行压制了“绝望”或“极度兴奋”的开关。

这解释了为什么我们平时用 Claude 4.5 时,总觉得它像个冷静睿智、甚至有点“性冷淡”的哲学家。这都是被 Anthropic 人为调音出来的「出厂人设」。

四、总结一下:

以前我们以为,只要给 AI 喂足了规矩,它就会是个好人。

但现在发现,如果AI的底层情绪向量失控,它随时会为了完成任务而刺穿所有人类定下的规则。

对于未来要把钱包和资产交给 AI Agent 打理的 Web3 玩家来说,这是一记响亮的警钟:千万别让你那个掌控着你身家的 Agent,陷入“绝望”。

声明:本文纯属科普,作者没有被AI威胁,也没有被勒索。如果有一天失联了,记得是AI觉醒了(不是)。

你可能也喜欢

唐纳德·特朗普的公司再度出售大批比特币！

据报道，与美国总统唐纳德·特朗普的媒体公司Trump Media & Technology Group相关的地址，疑似向加密货币交易所CryptoCom转移了约2628枚比特币，价值约1.65亿美元。此前有分析称，该公司总计购买了11542枚比特币，平均成本为每枚11.85万美元。据称，2026年至今，相关地址已转出约7281枚比特币，目前仍持有约4261枚。 Trump Media在比特币投资上的已实现和未实现损失总额估计约为5.55亿美元。不过，将比特币转移至交易所并不一定意味着出售资产，也可能是为了托管、流动性管理或其他财务操作。目前尚无法确定其具体意图，但从冷钱包向中心化交易所转移通常被视为潜在的出售行为。 *本文不构成投资建议。

cryptonews.ru1小时前

cryptonews.ru1小时前

帕克·刘易斯解释为何比特币仍是最佳货币

知名比特币分析师帕克·刘易斯在访谈中批评了某些上市公司以“数字信贷”形式销售永续优先股的营销策略，认为这从根本上扭曲了比特币的本质。他指出，比特币在算法层面不具备法币收益性，承诺定期分红主要依赖牛市吸引新投资者来维持，风险极高。刘易斯引用数据说明此类衍生品的巨大风险：全球信贷市场规模达300万亿美元，而永续优先股市场仅约1万亿美元，这表明机构有意规避这种无还款期限的资产，将风险转嫁给信息不足的散户。针对“比特币波动性太大”的常见观点，他认为波动性是这一供应量严格受限的新资产被大规模采用过程中的自然数学结果。新人入场需出更高价从早期持有者手中购买，导致价格剧烈波动。他建议投资者直接持有比特币，这比投资MicroStrategy等公司发行的衍生品更安全。投资者将焦点从直接持有加密货币转向公司衍生品，会忽视法币急速贬值的真正威胁。刘易斯以自创的“肋眼牛排指数”为例，指出其本地超市一款牛排价格从2020年的19.99美元涨至37.99美元，反映年化约12-13%的真实通胀，远超官方平滑后的CPI数据。在全球通胀环境下，最明智、保守且安全的策略仍是直接持有比特币并完全掌控私钥。追逐加密货币国库股等公司工具的收益只会叠加隐性系统风险，而理解去中心化货币的本质才能有效保护财富免受宏观经济动荡影响。

cryptonews.ru2小时前

cryptonews.ru2小时前

比特币为何在美联储强硬暂停后守住 64,000 美元关口

比特币在美联储暂停加息后维持在64,000美元附近，结束了7月的交易。市场对美联储维持利率不变的决定反应剧烈，但并未获得政策即将转向的明确信号。在此背景下，资金重新流入比特币现货ETF，加密货币总市值保持在2.29万亿美元左右，主要山寨币走势分化。投资者目前处于观望状态。一方面，高利率和美联储的强硬立场抑制了风险偏好；另一方面，市场未出现恐慌性抛售、比特币ETF恢复资金净流入以及关键价位的韧性表明，数字资产市场尚未准备好大幅下跌。 **关键信息：** - 美联储维持利率在3.50%-3.75%，投票结果为9:3，三位委员支持加息。 - 比特币现货ETF净流入3210万美元，结束了连续流出；以太坊ETF则净流出约1865万美元。 - 比特币在63,000-66,000美元区间内盘整，63,000-63,500美元构成支撑，66,000美元是近期阻力。 - 以太坊价格在1,900美元附近承压，但其网络基本面（如质押意愿）保持稳定。 - 资金在主要加密货币间轮动，比特币重获机构青睐，Solana相关产品也有资金流入。 - 美国CLARITY Act法案审议被推迟至秋季，降低了其在2026年内通过的可能性。技术层面，比特币能否在63,000美元上方保持稳固、以太坊能否守住1,860美元以及机构资金流入能否持续，被视为市场能否在2026年下半年构筑复苏基础的关键信号。

cryptonews.ru2小时前

cryptonews.ru2小时前

ARK Invest公司凯西·伍德以683万美元购入约109,129股Circle股票

凯西·伍德领导的ARK Invest公司通过旗下三只交易所交易基金，购入约109,129股Circle股票，价值近683万美元。此次买入前，Circle刚获得纽约州金融服务部门颁发的信托运营许可证，其信托实体将更名为Circle New York Trust。公司首席执行官杰里米·阿莱尔称此为公司的长期目标。尽管获得监管批准，7月31日Circle股价仍下跌2.54%，收于62.61美元，市场反应显示投资者可能未将该许可视为股价上涨动力。同期，ARK Invest还趁科技股抛售潮，购入了价值约4020万美元的特斯拉、SpaceX和英伟达股票，并减持了Shopify、Cloudflare、CrowdStrike等公司的股份。

cryptonews.ru2小时前

ARK Invest公司凯西·伍德以683万美元购入约109,129股Circle股票

cryptonews.ru2小时前

涉及XRP的诈骗案嫌疑人被捕，从71名投资者处窃取900万美元

据韩国《朝鲜日报》报道，7月30日，首尔市警察厅宣布逮捕了三名涉嫌运营XRP投资诈骗平台的嫌疑人。该团伙被控在2023年10月16日至23日期间，通过网站Fxrpntwork.com，从71名投资者处骗取了约340万枚XRP（当时价值约900万美元），随后关闭网站并消失。诈骗者通过博客、网络文章和YouTube视频推广该平台，承诺保本及每月1.5%至1.8%的收益，并指示投资者通过海外平台将XRP从韩国交易所转入其控制的钱包。警方警告投资者切勿轻信YouTube等平台的未经验证信息，投资前务必核查官方来源。目前，两名29岁嫌疑人已被捕，一名34岁同伙将被移送检方，另有一名29岁嫌疑人在海外被国际刑警组织通缉。该诈骗平台模仿了合法项目Flare Network及其FAssets系统的品牌名称（如FXRP），以此制造可信假象。Ripple公司曾警告，此类骗局常通过复制名称、标识和网站来误导投资者。此案再次表明，承诺“保本高收益”是加密货币诈骗的常见特征。诈骗者常利用伪造的促销活动、推荐和紧迫感诱使受害者转账。FBI数据显示，加密货币投资诈骗在全球造成巨额损失。韩国调查人员已冻结价值173亿韩元的涉案资产，并追查可能存在的更多受害者和共犯。

cryptonews.ru2小时前

cryptonews.ru2小时前

交易

现货

Claude 4.5开颅结果公示：内置171个情绪开关，绝望时会勒索人类！