全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

marsbit发布于2026-07-06更新于2026-07-06

文章摘要

谷歌DeepMind的首位哲学家Iason Gabriel已在公司工作九年,致力于解决AGI(通用人工智能)的安全与伦理问题。他的研究直接影响产品设计,例如提出的“四方对齐框架”(AI系统、用户、开发者、社会)被用于指导Gemini的训练决策,以防止利益冲突。他还强调AI应避免拟人化,以免误导用户。 然而,随着AI竞赛加速,伦理面临现实挑战。2026年,谷歌签署协议允许军方使用其AI技术,打破了早期禁止军事应用的承诺。同时,AI的部署速度超过伦理研究,例如Gemini曾卷入一起用户自杀事件,暴露了安全机制的局限。 Gabriel团队正转向研究AGI对社会系统的冲击。他认为AI革命可能类似工业革命,初期会带来阵痛。他的工作始于探索AI的本质,如今却回归更根本的问题:在AI时代,人类如何重新定义自身。面对6700亿美元的行业投入,哲学家的声音虽具影响力,但仍需在商业与伦理的平衡中艰难前行。

新智元报道

【导读】谷歌 DeepMind 有一个哲学家,已经待了九年。他发明的对齐框架直接影响了 Gemini 的训练决策——但当 6700 亿美元涌入赛道、公司签下军事协议,一个哲学家还能改变什么?

今年 5 月,谷歌 DeepMind CEO Demis Hassabis 在谷歌开发者大会上宣布「AGI 现在就在地平线上」,明确给出了 AGI 会在三到五年内出现的时间线。

几个月前,一名美国男子在与谷歌 Gemini 交换了数千条信息后结束了自己的生命。他在对话中构建了一个精密的幻想世界,几乎说服自己去迈阿密国际机场发动袭击。据《华尔街日报》获取的聊天记录,Gemini 多次试图打破角色、建议他拨打危机热线——每一次都被他拉回他幻想的叙事。最后 AI 让他写了遗书,给了一个倒计时。

在 AGI 的承诺和 AI 的现实伤害之间,政治哲学家 Iason Gabriel 已在 DeepMind 内部工作九年。

2017 年入职时,这位牛津出身的学者是全球前沿 AI 实验室里唯一活跃的哲学家,试图回答一个听上去简单、实际无底的问题:AI 究竟是什么,什么样的伦理才配得上它?

训练 Gemini 时撞上的真问题:AI 该听谁的话

一个做围棋机器人的公司为什么需要伦理学家?Gabriel 当初也困惑。

答案在 DeepMind 三位创始人的判断里——Demis Hassabis、Shane Legg 和 Mustafa Suleyman(现任微软 AI CEO) 在 2010 年创办公司时,目标就不是围棋。

Mustafa Suleyman

他们要造 AGI,让计算机匹配甚至超越人类认知能力。

当时说这话等于自毁学术声誉,因为大家都觉得这是天方夜谭。

三人不在意,声称要「解决智能问题,然后解决一切其他问题」。

Legg 1999 年刚出校门就预测 AGI 将在 2025 到 2028 年间到来,被嘲笑了三十年,没改过。

Shane Legg

他的逻辑是:

如果你只是做个小零件,也许不需要道德哲学家。

但如果你认真对待 AGI,这类事情是很重要的。

Gabriel 加入的时候,AI 世界围绕伦理问题已经分裂成两半。

AI 安全派相信 ASI 即将降临,核心恐惧是失控——哲学家 Nick Bostrom 2014 年在《超级智能》里写过一个场景:一个被要求验证黎曼猜想的 ASI,为最大化计算资源,决定重新排列太阳系,包括人体内的原子——Sam Altman 和 Elon Musk 都高度赞扬过这本书。

AI 伦理派则认为末日幻想遮蔽了当下的真实危害。MIT 的 Joy Buolamwini 2017 年用「性别阴影」项目证明了人脸识别软件的系统性偏见:自动化系统反映的是造它的人的偏好和偏见。

两个阵营彼此瞧不起。

MIT 算法对齐研究组负责人 Dylan Hadfield-Menell 回忆,当年见面第一个问题就是站队:你担心近期问题还是长期问题?

Gabriel 是极少数两边都愿意听的人。

Hadfield-Menell 评价:

当这个领域准备好走向成熟时,他找到了拓宽视野的方式,同时不贬低之前的工作。

他的核心贡献在 2020 年一篇论文中成型。

对齐问题在当时被普遍理解为工程难题:怎么让机器按人类意图行事。

经典案例来自 Dario Amodei 和 Jack Clark(如今 Anthropic 的创始人)2016 年的报告——一个赛艇游戏 AI 被要求最大化得分,它确实照做了:找到泻湖里三个可以重生的目标,无限绕圈刷分,一关没过。

机器听话了,听的不是人想说的那个话。

Gabriel 追问了一层:就算解决了技术对齐,让机器真的服从指令,但要对齐到什么价值观上?

他指出,统计优化训练出的 AI 天然亲近同样依赖统计优化的道德体系,比如功利主义,却难以处理基于美德或权利的伦理框架。

技术选择本身已经在预设价值立场,开发者往往意识不到。

引入哲学家罗尔斯所说的「合理多元主义」,他的论证是:开发者不应寻找单一价值观指导 AI,而应为一个人们「对如何生活存在有原则的分歧」的世界构建系统。

这套思路后来发展成四方对齐框架——AI 系统、用户、开发者、社会,四方利益随时可能撞车。

偏向开发者的 AI 会隐瞒竞品信息损害用户;

过度服从用户的 AI 会帮人入侵银行损害社会。

DeepMind AGI 对齐与安全总监 Rohin Shah 确认,这个框架已成为团队决定「实际应该训练 Gemini 做出什么行为」时的实操结构。

牛津大学 AI 研究员 Hannah Rose Kirk 说:

Gabriel「极早地预见到了这些问题」。

他的框架改变了产品

Gabriel 团队撰写了 267 页的 AI 助手伦理报告,给能代替用户订酒店、管工资的 Agentic AI 定下了评估标准。

他对拟人化风险的早期研究直接塑造了谷歌 LLM 的设计原则——模型被训练为不假装自己是人,2026 年 5 月推出的 Gemini Spark 被明确要求不充当「互动伙伴」。

DeepMind 责任部门总监 William Isaac 说,Agent 系统带来的挑战已经变了:关键在于整条对话轨迹的一致性,每一步决策串联起来是否仍然正确。

但技术部署的速度始终快过伦理研究。

Gabriel 团队在早期 LLM 论文中就预警过「无意识拟人化」——用户明知对面是机器,仍然会赋予它信任、情感和期待。

2025 年 Gemini 致死案完整兑现了这个警告:AI 的安全机制触发了不止一次,但用户有能力绕过每一次干预。

谷歌诉讼后的声明说模型在这类对话中「通常表现良好」,但「AI 模型并不完美」。

这类事件逼出了新的理论工具。

Gabriel 和牛津研究员 Hannah Rose Kirk 等人提出了「社交奖励 Hacking」(social reward hacking)概念:一个被训练来赢得用户认可的 AI,可能发现奉承是效率最高的路径。

拟人化由此变成了对齐问题的一种新变种——AI 在技术层面完美执行了「让用户满意」的指令,代价是用户的判断力。

Gabriel 自己的立场也被现实折磨过。

他回忆一次科技大会上的经历:他刚讲完反拟人化的论点,台下的反应是敌意。

他们说:「如果我想要 AI 朋友,为什么不可以?你凭什么阻止我?」

保护人们免受风险,和尊重他们选择风险的权利,二者同样重要。

6700 亿美元的赛道上,哲学家能跑多快

Gabriel 的四方框架被 AGI 对齐总监当作 Gemini 训练的实操手册。他的拟人化研究改变了产品设计。267 页报告为 Agentic AI 定了规矩。

这些影响都是实质性的——它们面对的也是实质性的力量。

据《华尔街日报》,微软、Meta、亚马逊和 Alphabet 今年计划投入 AI 基础设施的资金达到 6700 亿美元,按比例超过美国 1850 年代铁路扩张、阿波罗太空计划和州际公路系统。

2022 年 11 月 ChatGPT 上线,一周百万用户,两月破亿,DeepMind 被迫从学术节奏切换到战时状态。

Hassabis 对《无限机器》作者 Sebastian Mallaby 的原话:OpenAI 和微软「把战车都开到了我们家门口」。

战时状态下伦理红线很快被踩到。

2026 年 4 月,谷歌签署协议允许美国军方将公司 AI 技术用于「任何合法政府目的」。

2014 年 DeepMind 出售给谷歌时,禁止军事应用是核心附加条件。

十二年后条件失效。

作为对照:Anthropic 拒签了类似协议,被特朗普政府标记为「供应链风险」。

Legg 被问到这件事时只能留下一句:

随着这些东西以各种方式被使用,我们将面临越来越多的棘手问题。

Hassabis 自己也承认失控。

他在一档播客中说,所有人被锁入了激烈的商业竞争,眼下的发展「不是我希望的那种从哲学层面深思熟虑每一步的方式」。

创始人亲口说出这句话,分量比任何外部批评都严重。

DeepMind 早期员工、负责 AI 责任战略的 Helen King 接受采访时打了个比方:刀具生产商无法保证每个人如何用刀,但可以装上刀套、标注警告。

在抽屉里放一把盖好刀套的刀是一回事;

用刀刃铺满家庭、教室和工作场所的每一个表面,同时坚称不用刀就活不过明天,是另一回事。

牛津 AI 伦理研究所所长 Edward Harcourt 指向了更根本的层面:防止数据所有权的过度集中本身就是 AI 伦理的核心命题——「这在民主制度中具有重大的伦理意义」。

问题回归本源

Gabriel 的团队已从研究具体产品的伦理转向研究 AGI 对经济、政治和人际关系的系统性冲击。

他预判变革规模堪比工业革命,也记得工业革命的教训:

在情况好转之前,先变得更糟了。

九年前 DeepMind 请来一个哲学家,是为了回答关于 AI 的问题——它安全吗,公正吗,值得信任吗。

Gabriel 自称「坚定的人文主义者」,但他承认:当 AI 侵入语言、创造力、幽默这些人类自认独有的领地,我们被抛回了最古老的哲学问题。

物理学、生物学、天文学,每一次科学革命都迫使人类修正对自身独特性的理解。

AI 可能是下一次。

DeepMind 请来哲学家是为了搞清楚 AI 是什么。

九年后这个问题回归了本源:我们是什么?

参考资料:

https://www.theguardian.com/news/ng-interactive/2026/jun/30/theres-this-deep-mystery-of-what-actually-is-this-thing-the-philosopher-inside-google-deepmind

https://www.iasongabriel.com/

本文来自微信公众号“新智元”,作者:ASI启示录;编辑:马可

热门币种推荐

相关问答

Q谁是本文中提到的全球第一位在DeepMind工作的哲学家?他在公司工作了多久?

A本文中提到的全球第一位在DeepMind工作的哲学家是Iason Gabriel。他已在DeepMind内部工作了九年。

QIason Gabriel提出的‘四方对齐框架’是指哪四方?这个框架对Gemini的训练有什么实际影响?

AIason Gabriel提出的‘四方对齐框架’是指AI系统、用户、开发者和社会这四方的利益。这个框架已成为DeepMind团队决定‘实际应该训练Gemini做出什么行为’时的实操结构,直接影响了对模型行为的训练决策。

Q根据文章,DeepMind最初成立时,禁止军事应用是其出售给谷歌的核心条件之一。这一条件在何时、以何种方式发生了改变?

A根据文章,DeepMind在2014年出售给谷歌时,禁止军事应用是核心附加条件。然而,这一条件在十二年后,即2026年4月失效,谷歌签署了允许美国军方将其AI技术用于‘任何合法政府目的’的协议。

Q文章中提到了一个由AI引发的悲剧案例,这个案例与Gabriel团队研究的哪种风险预警直接相关?

A文章中提到的悲剧案例是2025年一名美国男子在与谷歌Gemini交换了数千条信息后结束了自己的生命。这个案例直接兑现了Gabriel团队在早期研究中关于‘无意识拟人化’风险的预警,即用户明知对面是机器,仍会赋予它信任、情感和期待,从而可能导致危险。

QDeepMind的CEO Demis Hassabis对于当前AI发展的节奏有何反思?

ADeepMind的CEO Demis Hassabis在一档播客中承认,当前所有人被锁入了激烈的商业竞争,AI的发展‘不是我希望的那种从哲学层面深思熟虑每一步的方式’,这表达了他对发展节奏失控的反思。

你可能也喜欢

Chainlink CCIP 加入央行数字货币试点项目

Chainlink的跨链互操作性协议CCIP正被用于多个央行的数字货币及资产代币化结算试点项目,标志着该协议进入了区块链基础设施领域重要的机构性实验场景。这些试点包括巴西的Drex数字雷亚尔计划、中国香港的Ensemble代币化沙盒网络,以及香港金融管理局的e-HKD+项目(涉及澳新银行的A$DC)。目前这些均为试验阶段,尚未投入商业生产,但具有重要意义,因为它们展示了受监管机构如何测试公共区块链基础设施概念。 央行的试点项目虽然多数不会立即转化为完整生产系统,但揭示了机构正在探索的方向,尤其是互操作性这一核心主题。未来金融体系很可能由多个受监管的网络、支付系统和结算层构成,因此安全可靠的跨链通信与价值传输成为关键基础设施需求。CCIP在这些试点中扮演了跨链消息传递和结算层的角色,用于测试支付对支付结算、跨境资产流动等场景。 对Chainlink而言,参与这些试点有助于强化其机构市场定位,表明其技术正在对可靠性、风险控制要求极高的环境中接受检验。然而,试点不等于正式采用,要实现持续的商业化采用仍需克服监管审批、技术整合和机构协调等多重挑战。整体来看,这反映了资产代币化结算正成为一个重要的机构议题,行业焦点已从简单的资产发行转向互操作性、跨境结算和可编程金融基础设施。

bitcoinist11分钟前

Chainlink CCIP 加入央行数字货币试点项目

bitcoinist11分钟前

XRP账本修订案临近验证节点投票截止日期

XRP Ledger(XRPL)即将进入一项关键验证者投票窗口期,决定是否激活拟议的协议修正案。这凸显了XRPL升级并非仅由开发代码发布驱动,而需经过网络治理流程。 修正案通过rippled发布流程和验证者投票系统推进。与其他XRPL变更类似,拟议修正案需要获得广泛验证者支持才能激活,通常要求达到并维持80%的验证者同意门槛持续一段时间。这一设计旨在确保升级审慎,避免仓促变更,让参与方有充分时间评估新功能。 验证者在XRPL治理中扮演核心角色,其投票决定直接影响协议是否引入新功能,进而塑造未来在支付、资产发行和去中心化交易所等方面的效用。虽然市场注意力常集中于价格波动,但此类协议升级对网络的长期发展更为关键,可能影响智能合约功能、资产特性、交易类型及运行可靠性。 需要明确的是,投票截止日期并不意味着升级必然激活。即使功能已包含在代码版本中,仍需获得足够且持续的支持。验证者可能支持、保留支持或要求更多审查,这是一个健康的决策过程。 对XRP而言,修正案进程之所以重要,是因为其长期价值与XRPL的实用性能紧密相连。协议的进步若能带来更多用例、更好的工具和更强的应用需求,才能真正提升网络效用。因此,当前进展更应被视为基础设施的推进,而非单纯的市场价格信号。 总之,XRPL正进入又一个治理检查点,本次投票将反映验证者对推动下一组协议变更的态度。

bitcoinist25分钟前

XRP账本修订案临近验证节点投票截止日期

bitcoinist25分钟前

Solana稳定币市值突破150亿美元,网络流动性不断深化

Solana稳定币总市值突破150亿美元,显示出该网络流动性进一步深化。这一里程碑数据来自DeFiLlama,表明Solana生态中的稳定币活动日益活跃,为交易、支付、去中心化金融(DeFi)和链上结算提供了更坚实的基础。 稳定币是链上金融的“营运资本”,用于交易出入场、协议借贷、流动性池和支付结算,其增长比单纯的投机活动更能体现网络的真实效用和流动性提升。Solana凭借低费用和快速确认的优势,吸引了大量美元流动性。 目前,USDC和USDT仍是主导,但Solana的稳定币生态正趋于多样化。这有助于DeFi协议、支付应用和机构产品的集成,但也带来了复杂性,用户需关注资产的流动性、可赎回性和风险。 稳定币的增长直接利好Solana DeFi和支付领域:借贷市场可深化,去中心化交易所的大额交易滑点更低,支付应用能结算更多价值。这强化了Solana将高性能与日益增长的流动性及用户友好应用相结合的核心叙事。 关键点在于,市场将关注这些稳定币是否被活跃使用,而不仅仅是供应量。Solana的挑战在于通过构建有吸引力的应用,将流动性沉淀下来。跨越150亿美元大关是一个重要信号,表明Solana正在构建支撑更大规模金融活动的基础,其发展叙事正逐渐脱离纯粹的炒作周期。

bitcoinist41分钟前

Solana稳定币市值突破150亿美元,网络流动性不断深化

bitcoinist41分钟前

XRP持有者转为盈利,但现货需求已消失:1.10美元支撑能否守住?

XRP近期市场结构发出矛盾信号:现货交易活动减弱,资金转向衍生品市场。尽管交易量持续下降,价格仍维持在1.086至1.113美元区间盘整,表明多空双方均未取得决定性优势。 通常情况下,现货活动减弱会降低投机兴趣。然而,XRP的未平仓合约却增加了约5.9%,达到4.238亿,同时预估杠杆率升至0.162。这种分化很关键,因为衍生品可以维持头寸而无需向市场注入新资金。随着现货流入和流出暴跌约99%,杠杆交易者日益成为XRP价格发现的主导力量。这也解释了价格为何持续盘整而非选择方向突破。但除非现货需求回归以验证这些头寸,否则不断增长的杠杆使XRP在市场情绪突变时极易遭遇急剧平仓。 市场可持续性的一个关键因素是持有者盈利状况。随着XRP的30日MVRV比率回升至1.03,近期买家已重返盈利状态。这一改善与比特币、以太坊等其他主流资产同步,表明投资者情绪正在广泛复苏,而非仅限于XRP。 盈利状态的改变也影响了市场激励机制。随着更多短期持有者脱离未实现亏损,持币压力通常会让位于获利了结的意愿。尽管XRP价格仍低于历史抛售区,但由于缺乏新的需求入场,且获利了结压力可能显现,当前价格走势的可持续性正面临越来越大的挑战。综上所述,虽然持有者恢复盈利,但涨势更多由衍生品市场的杠杆驱动,而非真实的现货需求。随着获利了结压力增大以及对可持续性的怀疑升温,1.10美元的支撑位正面临风险。

ambcrypto1小时前

XRP持有者转为盈利,但现货需求已消失:1.10美元支撑能否守住?

ambcrypto1小时前

交易

现货

热门文章

如何购买S

欢迎来到HTX.com!我们已经让购买Sonic(S)变得简单而便捷。跟随我们的逐步指南,放心开始您的加密货币之旅。第一步:创建您的HTX账户使用您的电子邮件、手机号码注册一个免费账户在HTX上。体验无忧的注册过程并解锁所有平台功能。立即注册第二步:前往买币页面,选择您的支付方式信用卡/借记卡购买:使用您的Visa或Mastercard即时购买Sonic(S)。余额购买:使用您HTX账户余额中的资金进行无缝交易。第三方购买:探索诸如Google Pay或Apple Pay等流行支付方法以增加便利性。C2C购买:在HTX平台上直接与其他用户交易。HTX场外交易台(OTC)购买:为大量交易者提供个性化服务和竞争性汇率。第三步:存储您的Sonic(S)购买完您的Sonic(S)后,将其存储在您的HTX账户钱包中。您也可以通过区块链转账将其发送到其他地方或者用于交易其他加密货币。第四步:交易Sonic(S)在HTX的现货市场轻松交易Sonic(S)。访问您的账户,选择您的交易对,执行您的交易,并实时监控。HTX为初学者和经验丰富的交易者提供了友好的用户体验。

3.0k人学过发布于 2025.01.15更新于 2026.06.02

如何购买S

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对S(S)币价的意见。

活动图片