AI也会“闹情绪”!中科大新研究:困惑和焦虑让AI更会干活儿

marsbit发布于2026-08-16更新于2026-08-16

文章摘要

中科大与牛津等机构的研究发现,让AI识别并使用“情绪”能显著提升其任务执行能力。研究指出,大型语言模型内部存在与人类情感标签对应的计算模式,如好奇、困惑、紧张等。当AI基于特定情绪自动选择相应技能时,任务完成效果更好。 例如在购物任务中,AI感到好奇和渴望时会搜索产品,困惑紧张时会重新查询,认可乐观时会确认购买,失望恼怒时则比较价格。实验显示,这种情绪与技能配对的语义连贯性高达76.5%。 在传统设计中,AI错误通常被抑制,但研究表明“坏情绪”如紧张、困惑可作为有用的元认知信号,提示当前策略与环境不匹配,从而触发调整机制。在成功率原本很低的任务(如“加热物品”)中,引入情绪驱动技能选择后,成功率从9.6%大幅提升至56.9%。情绪信号能帮助AI在错误发生前捕捉内部状态变化,提前调整策略。 此外,天津大学的研究将情绪嵌入世界模型,通过预测未来情绪状态来引导对世界状态的预测,准确率最高提升45.72%。移除情感数据后,AI的逻辑推理等能力也会下降。 这些研究表明,AI的内部情绪正从观察对象转变为可提取、利用的功能性信号,能够增强其在复杂任务中的适应性和鲁棒性。

程浅 发自 凹非寺量子位 | 公众号 QbitAI

AI的“情绪”也会影响工作状态?

最近,中科大、牛津等机构研究者让AI用情绪向量替代文本做技能选择,结果发现——

允许AI识别这些“内心情绪”并由此做出行动,能大幅提升AI的工作能力......

此前研究认为,LLM内部存在着与人类情感标签高度对应的计算模式。

包括不限于:好奇、渴望、乐观、困惑、紧张、恼怒

AI可提取的情绪表征

而当模型感知到这些情绪并以此作为自己行动依据时,任务将完成得更好......

允许AI不保持“情绪稳定”

此研究者发现:AI特定的情绪状态特定的技能选择之间存在着连贯的配对关系。

何意味?

实际上这件事在我们人类身上几乎是默认的,以至于很难察觉到:我们的情绪决定了我们接下来要做什么。

在实验中,研究者让AI去购物,这一过程中,Agent自动形成了四种可解释的配对模式:

第一种:当Agent感到好奇且渴望时, 它会去自发搜索产品

此时仍沉浸在购物的新鲜感和探索欲的满足之中。

第二种:当Agent感到困惑且紧张时,它会去自发查询重述

当搜索结果不理想时Agent开始困惑不安,它选择换一些关键词重新提问

第三种:当Agent觉得认可且乐观时,它会去自发确认购买

此时Agent对自己挑的商品很满意,果断提交了订单。

第四种:当Agent终于失望且恼怒时,它会去自发去比较价格。

此时Agent在进行多次搜索后已经积累了大量的负面情绪,这时它会转向价格比较,试图货比三家。

为了验证这些配对不是统计巧合,研究者抽取了200次技能选择事件,让AI独立判断每次配对是否在语义上连贯,结果显示一致性比例高达76.5%。

接受“坏情绪”有助于提升任务成功率

在传统设计中,AI 犯错被视为一种需要被抑制或消除的异常

但该研究指出,在那些需要频繁从失败中恢复的任务中,情绪的作用效果尤为显著

所谓的“坏情绪”,如紧张、困惑、失望等,实际上是非常有用的元认知信号——

因为它们标志着当前策略与外部环境之间的失配,与其强行维持“情绪稳定”而忽略错误信号,不如让Agent直接去“感受”这种失配,从而触发针对性的恢复机制。

换句话说,情绪在此处是鲁棒性的来源,而非脆弱性的表现

本研究中,研究者给AI布置了六类家务,其中“加热物品”和“拾取两个物品”的成功率非常之低,分别只有9.6%和4.4% 。

然而在采用情绪驱动技能选择(EMOTION2SKILL)后,该任务成功率大幅上升,竟然提升到了56.9%......而“拾取两个物品”也上升到了31.3%!

怎么做到的?

实际上这两类任务都有一个共同特征,那就是Agent只要去做,就几乎一定会犯错,而最终的成功仅取决于它能否在犯错后快速调整策略

令人深思......

论文给了一个很直观的例子:让Agent“加热一个杯子并放到台面上”。

通常Agent做法是:导航到微波炉,执行“加热杯子”,将杯子递出去的时候收到反馈:“微波炉是关着的,任务失败。”

此时失败信号在错误行动之后出现。

而采用情绪驱动技能选择后,当Agent接近关着的微波炉时,情绪编码器率先检测到了它的“紧张”状态

基于这种不安的情绪,Agent的路由被引导至“先检查”,再“打开微波炉” ,再“加热”的子序列,任务顺利完成

关键就在于,如果只依赖外部文本和失败反馈,Agent往往要等到错误真正发生后,才知道应该换策略;而情绪信号则有机会在失败信号出现之前,提前捕捉到内部状态的变化。

论文的消融实验也证实了这一点,在所有任务类型中,“加热”和“捡两个东西”这两类任务激活频率最高的情绪模板分别是“挫败”(41%)和“困惑”(39%)。

换句话说,在这些情况下,坏情绪可能才是最有用的信号。

世界模型也开始用情绪做预测

其实,不只是Agent在技能选择上利用情绪信号,天津大学的研究将情绪直接嵌入了世界模型中(Large Emo tional World Model, LEWM)。

通常,世界模型的任务是预测“接下来会发生什么”并据此行动。

传统的世界模型在面向以人为中心的环境时,往往陷入一种“物理还原论”的误区。

只要我们能够精准预测物体的位置、姿态及物理状态的演化,就能够理解并模拟人类环境。

然而在以人为中心的环境中,情感并非一种噪声,它是驱动人类行动与引发未来环境变化的重要内生因果变量。

就比如,开车追尾后,一个人瞬间产生的情绪可能最终使他安然无恙,或者遍体鳞伤

研究插图

LEWM由此将预测分成两步:

第一步,预测未来的情绪状态;

第二步,以预测出的情绪作为条件信号,引导对未来世界状态的预测。

在其自建数据集上,该方法的准确率最高提升45.72%。

该研究进一步通过消融实验发现:

从AI系统中移除情感数据后,性能下降不仅局限于情感理解等任务,更波及到了看似完全无关的逻辑推理与通用问答能力......

AI 的情绪正在变成一种可用的「功能」

实际上,这两个研究背后共享着一个更早些时候的发现:

LLM的内部,确实存在一些可以被“读出来”的情绪表征。

这来自于今年4月Anthropic的一次实验。

研究人员从Claude Sonnet 4.5的内部激活中,提取出了与Go Emo tions 27类情感分类体系对齐的细粒度情绪方向,且这些方向因果性地影响Agent相关的行为输出。

“小狗去世”带来的悲伤情感最显著,而Loving存在于所有事件中

在过去,研究者关注模型“是否有情绪”更多是出于对齐安全或哲学思辨的考量。

而现在,模型的内部状态正从纯粹的学术观察对象,转变为可以被提取、被利用、被整合进系统设计中的功能性信号

参考链接:[1]https://arxiv.org/pdf/2608.09248[2]https://arxiv.org/abs/2512.24149[3]https://transformer-circuits.pub/2026/emotions/index.html

本文来自微信公众号 “量子位”(ID:QbitAI),作者:关注前沿科技

热门币种推荐

相关问答

Q根据文章,中科大等机构的研究发现,让AI识别并依据什么来做技能选择,能大幅提升其工作能力?

A允许AI识别其内部的“内心情绪”(如好奇、渴望、困惑、紧张等情绪向量),并以此作为行动依据,能大幅提升其工作能力。

Q在购物任务的实验中,AI Agent在感到“困惑且紧张”时,通常会自发采取什么行动?

A当AI Agent感到“困惑且紧张”时,它会自发进行“查询重述”,即换一些关键词重新搜索。

Q研究指出,在哪些类型的任务中,情绪(尤其是“坏情绪”)的作用效果尤为显著?

A在那些需要频繁从失败中恢复的任务中,情绪的作用效果尤为显著。“坏情绪”如紧张、困惑、失望等可以作为元认知信号,帮助AI触发针对性的恢复机制,从而提升任务成功率。

Q天津大学的研究中,LEWM(大型情感世界模型)如何利用情绪进行预测?

ALEWM将预测分为两步:第一步,预测未来的情绪状态;第二步,以预测出的情绪作为条件信号,来引导对未来世界状态的预测。这种方法将情感视为驱动人类行动和引发环境变化的重要内生因果变量。

Q文章提到,有更早的研究发现为当前利用AI情绪的研究提供了基础,这个发现是什么?

A今年4月Anthropic的实验发现,大语言模型(LLM)内部存在可以被“读出来”的情绪表征,研究人员能从其内部激活中提取出与细粒度情感分类对齐的情绪方向,这些方向能因果性地影响AI Agent的行为输出。

你可能也喜欢

SafePal 泄露近 4 万名硬件钱包买家资料:私钥没丢,危险反而更接近肉身

硬件钱包厂商 SafePal 近日发布安全公告,确认其订单查询插件存在授权缺陷,导致在2025年3月至2026年4月期间下单的近4万名客户的姓名、邮箱、电话号码、收货地址及购买记录遭到未授权访问。公司强调,私钥、助记词等核心资产信息未受影响,因为冷钱包系统与电商服务器完全隔离。 此次泄露的数据具有高度敏感性,因为它精准标识了持有加密资产且可能金额较大的群体。攻击者利用这些真实的个人信息,可发起高针对性的社会工程学攻击,例如发送包含真实订单详情的钓鱼邮件、寄送伪造的硬件或实体信件进行诈骗,甚至可能结合其他信息对用户进行人身威胁(“扳手攻击”)。SafePal已发现并下架了超过30个相关钓鱼网站。 事件披露时间线存在延迟:公司早在5月就接到钓鱼报告,但最初视为孤立事件,直至8月才公开确认漏洞。此外,由于数据清理程序配置错误,本应被删除的旧订单数据得以留存并最终泄露,扩大了影响范围。这与硬件钱包厂商Ledger在2020年经历的数据泄露事件性质相似。 此次事件暴露了硬件钱包行业的一个根本矛盾:冷钱包旨在通过物理隔离保护私钥,但其销售环节却必须收集用户真实身份信息,这些信息一旦从电商渠道泄露,将使持有者暴露于网络和现实风险之中。 对于受影响的用户,应立即核查是否收到可疑的“固件升级”或“设备召回”通知,切勿在任何情况下泄露助记词。建议通过官方渠道验证自己是否受影响,并考虑申请删除个人信息。未来数月需对所有提及SafePal的通讯保持警惕,并评估资产存放地的物理安全。安全链条中最脆弱的一环往往是人本身。

marsbit28分钟前

SafePal 泄露近 4 万名硬件钱包买家资料:私钥没丢,危险反而更接近肉身

marsbit28分钟前

被 AI 碾压 30 年后,人们重新爱上了下棋

1997年,IBM的“深蓝”击败国际象棋冠军卡斯帕罗夫,引发人类智力尊严的讨论。2016年,AlphaGo战胜围棋棋手李世石,次年又横扫柯洁,AI似乎宣告了人类在智力游戏上的失败。然而,近30年后,国际象棋平台Chess.com却拥有2.5亿用户,人气达到历史巅峰。 Chess.com的CEO回顾了网站的增长:2020年疫情和网剧《后翼弃兵》带来第一波流量;2023年,短视频平台和一只名为Mittens的AI小猫机器人引发病毒式传播,使国际象棋持续破圈。关键在于,每次浪潮退去后,用户基线都稳固提升。 AI并未扼杀国际象棋,反而解放了游戏的纯粹性。当“人类最强”的悬念被终结,胜负焦虑消散,下棋回归到“为了好玩”的本质。AI变成了基础设施——作为随身教练、反作弊工具,甚至成为吸引新用户的内容。 相比之下,围棋在职业层面经历了“意义的塌缩”。围棋在东亚文化中承载更多功利与精英色彩,当AI颠覆了传统定式和艺术性,以结果为导向的生态便难以维系。职业棋手风格趋同,故事性减弱,尽管有棋手通过直播成为网红,但围棋本身的大众参与度并未像国际象棋那样提升。 国际象棋的复兴揭示了一个核心问题:在AI时代,一件事能否持续,不取决于“谁做得更好”,而取决于“人类做这件事时,究竟在享受什么”。那些过程本身就是奖励的活动——如下棋、艺术创作等——可能因卸下“赢”的压力而更加纯粹;而那些仅为结果而做的事,则可能被AI自然取代。

marsbit42分钟前

被 AI 碾压 30 年后,人们重新爱上了下棋

marsbit42分钟前

退出贵州茅台前十,“长线资金”调仓路线显现,社保基金新进12股,布局硬科技摩尔线程

随着上市公司半年报陆续披露,社保基金、保险资金等长线资金二季度持仓情况显现。被视为“国家队”的中央汇金资产管理有限责任公司和中国证券金融股份有限公司,已退出贵州茅台前十大股东之列,同时也退出了平安银行、大华股份等公司前十大股东行列。 数据显示,截至8月14日,社保基金出现在33家A股公司前十大流通股东中,总持仓市值超110亿元,其中新进个股12只,涵盖化工、食品饮料、半导体等行业。社保基金持仓保持稳健风格,偏好业绩确定性强、估值合理的标的。具体而言,持股市值最高的是鹏鼎控股;江河集团获加仓最多;部分科创板未盈利企业如GPU芯片公司摩尔线程也获得青睐。 险资方面,二季度重仓41家公司,持股市值超260亿元,海康威视持仓市值最高。险资增持了有色金属、化工等周期股,同时对高股息板块如中国移动保持青睐。 分析指出,社保基金资金周期长、风险容忍度较高,采取分散布局,兼顾消费、周期与科技成长。险资则受负债端约束,注重资产负债久期匹配,布局兼顾分红与弹性。当前市场经历调整后出现企稳迹象,预计长线资金将延续“价值底仓搭配成长布局”的双线配置逻辑,高股息资产作为组合底仓,硬科技、高端制造等新质生产力相关产业将获持续关注。

marsbit52分钟前

退出贵州茅台前十,“长线资金”调仓路线显现,社保基金新进12股,布局硬科技摩尔线程

marsbit52分钟前

超过5.4万名钱包用户数据泄露,CLARITY法案通过几率骤降至10%:Hodler's Digest,8月16日

银河数码将《清晰法案》在2026年通过的概率从5月的75%大幅下调至仅10%。该法案面临诸多政治议题待解,且参议院9月14日复会后仅有14个工作日可进行表决。若未能在复会后立即启动程序,法案通过将极为困难。若法案失败,SEC与CFTC计划自行制定加密市场规则,但SEC原定公布规则的路演会议因“计划冲突”突然取消。据悉白宫担忧SEC单独行动可能破坏《清晰法案》的谈判。周三,SEC主席、特朗普总统及多家加密企业高管将在白宫会面商讨推进法案。 与此同时,加密货币公司正寻求前沿人工智能(AI)的网络安全支持,因黑客威胁加剧。近期,Coldcard硬件钱包遭窃1.16亿美元,而Trezor和SafePal相继发生数据泄露,共涉及超5.4万名用户信息,导致钓鱼攻击风险上升。 CFTC与州政府就预测市场(如Kalshi和Polymarket)的监管权发生冲突。CFTC命令Kalshi无视纽约州的禁令继续运营,但华盛顿州法官则要求其停止在该州的业务。纽约市议会也启动了对预测市场涉嫌误导营销的调查。 以太坊基金会调整了后量子计划,放弃Poseidon哈希函数,转向SHA或BLAKE等方案,并为明年计划的Hegotá升级筛选提案。此外,Tether完成了首份由KPMG审计的全年财报,显示其储备金超出负债68.14亿美元。 市场方面,比特币本周下跌3.3%至62,842美元,以太坊跌2.3%。Swan CEO预测比特币或在10月触底,随后在2028年减半前回升至13万美元附近。但亦有分析指出,比特币2030年涨至100万美元“数学上不可能”。 其他事件包括:Glassnode指标显示比特币处于FTX崩盘以来最长“投降期”;密苏里州三人因策划绑架比特币持有者被捕;以及萨尔瓦多比特币法五周年回顾等。

cointelegraph1小时前

超过5.4万名钱包用户数据泄露,CLARITY法案通过几率骤降至10%:Hodler's Digest,8月16日

cointelegraph1小时前

交易

现货

热门文章

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

2026年,美股IPO市场重回高热度。本文梳理即将上线或受关注的热门赛道龙头,分析具备投资潜力的交易标的及其逻辑,并探讨宏观趋势与相关风险。

2.8k人学过发布于 2026.07.08更新于 2026.07.08

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对AI(AI)币价的意见。

活动图片