Claude开始自主设计新蛋白质,效率超越人类专家数十倍

marsbit發佈於 2026-08-19更新於 2026-08-19

文章摘要

Anthropic公司让Claude人工智能自主设计蛋白质结合剂,在针对15个靶标的测试中成功命中14个。实验共生成1320个设计,其中354个经独立实验室验证有效,总成功率达26.8%,是行业平均水平(10%-15%)的两倍多。若仅看Claude自评排名第一的设计,命中率高达49%。 研究人员通过编写约1.6万词的提示词,将蛋白质工程师的专业知识和流程编排赋予Claude。Claude在接到任务后,自主调用包括RFdiffusion、ProteinMPNN在内的现有开源工具,完成选择靶点、设计序列、优化筛选等全套流程,全程无人干预设计决策。在多靶标模式下,处理14个靶标仅需48小时。 在具体案例中,Claude在曾举办过公开设计竞赛的RBX1蛋白上取得显著成果,其最佳设计的结合紧密程度是原竞赛冠军的十倍。在难度较高的TNFα靶标(与明星药物Humira相关)上,Claude也成功设计出多个有效结合剂。 Anthropic已开源全部提示词、数据和设计模型。公司出于安全考虑,已在公开版Claude中封锁了相关生物能力。这项成果标志着AI在短短六年内,已从预测蛋白质结构(AlphaFold)发展到自主设计蛋白质。

Anthropic 让 Claude 自己设计蛋白质,15 个靶标命中 14 个——这个成绩让内行研究者惊讶。

8 月 18 日,Anthropic 公布了一项实验结果:Claude(Mythos Preview 和 Opus 4.8)自主完成了一整套蛋白质设计流程。

给它 15 个蛋白质靶标,让它自己设计能结合上去的新蛋白质,14 个靶标成功。

1320 个设计中 354 个经两家独立实验室验证有效,总成功率 26.8%。

这个领域的行业平均是 10%–15%。

蛋白质结合剂是很多药物起效的基础:先设计一个分子能抓住靶标蛋白,后面才有可能做成药。

这个设计过程通常需要蛋白质工程师数周的计算、优化和筛选。

从 AlphaFold 到 Claude预测蛋白质和设计蛋白质是两件事

2020 年 AlphaFold 做的事:给定一段蛋白质序列,预测它折叠成什么形状。

输入已知,输出是预测。

它是专门训练的蛋白质模型,做一件事做到极致。

而 Claude 这次做的事不同。

它拿到的只有靶标蛋白的名字,任务是从零设计一个全新蛋白质去结合它。

输入是名字,输出是新蛋白质。

一个是看图说话,一个是命题作文。

Claude 用的工具全是现成的——RFdiffusion、ProteinMPNN、ESMFold2,这些蛋白质设计和结构预测的开源模型早已存在,任何实验室都能下载。

Claude 没有发明新工具,它做的是编排:研究团队写了一份约 1.6 万词的提示词,把蛋白质工程师的工作知识编进去,包括实验各阶段、每阶段可用的工具和筛选标准。

这份提示词不指定从蛋白质哪个面下手,不指定用哪种生成方法,不预设任何序列。

丢给 Claude,给一个云服务器账户,让它跑。

多靶标模式下 48 小时一个 Session 同时处理 14 个靶标,单靶标模式下每个靶标 24 小时。

人类操作员只做了三件事:批准网络访问、监控基础设施、把 Claude 排好序的设计送去两家独立实验室(Adaptyv Bio 和 Twist Bioscience)合成和检测——没有人介入任何设计决策。

Claude 自己选靶点、选表位、装工具、跑模型、筛选优化、排序交付,最终调用了 10 种结构生成方法,拼出 24 种工具组合。

结果

蛋白质设计领域目前的平均成功率是 10%–15%。

Claude 在不同模式下跑出 22%–35%,是行业均值的两到三倍。

https://x.com/AnthropicAI/status/2089842389682954621

如果只看 Claude 自己排名最高的那个设计,命中率是 49%:每两个靶标,排第一的设计就有一个直接能用。

几个靶标的结果值得单独说。

Adaptyv Bio 之前针对一个叫 RBX1 的蛋白办过公开设计竞赛,全球参赛者提交 245 个设计,只有 9 个成功。

Claude 在同一个靶标上提交 90 个设计,28 个成功,最佳设计抓靶标的紧密程度是竞赛冠军的十倍。

TNFα 是个更难的靶标——全球最畅销药物之一 Humira 就靠结合这个蛋白起效,但多个专家团队此前尝试从头设计结合剂,全部失败。

Opus 4.8 产出了 12 个有效设计,部分还能跨物种同时结合人、猴、鼠的 TNFα。

也有翻车:一种叫 MBP 的蛋白上,90 个设计全军覆没。

分析化学方向也有类似信号。

给 Claude Opus 5 一份核磁共振仪器的原始数据和一句话指令,23 分钟出结果,和实验室化学家半小时到一小时的手工分析结论一致。

两个实验方向不同,信号一致:Claude 这个通用模型在需要专家数周完成的科研任务中,在 24 到 48 小时内(多靶标模式 48 小时,单靶标模式 24 小时)自主跑出了经实验室验证的专家级结果。

短短六年,天翻地覆

结合剂距离药物还很远,中间隔着毒理、临床试验等环节,每步都要数年。

所有结构都是计算预测,未经实验结构验证。

Claude 用的全是开源工具,Anthropic 已把提示词、数据和全部 1440 个设计模型开源在 HuggingFace 上,任何实验室都可以复现。

https://huggingface.co/datasets/Anthropic/claude-protein-binder-design/tree/main

这类自主科研能力同时有双重用途的风险,Anthropic 在公开版 Claude 中封锁了蛋白质设计等生物能力。

从 AlphaFold 预测蛋白质结构到 Claude 自主设计蛋白质,仅仅过去了六年。

参考资料:

https://www.anthropic.com/research/Claude-accelerates-protein-design

https://www-cdn.anthropic.com/30bf50e22a01388bb29bf077ee3f244531594b7a.pdf

本文来自微信公众号“新智元”,作者:ASI启示录

相關問答

QClaude自主设计蛋白质的实验取得了什么样的具体成果?

AAnthropic让Claude自主设计针对15个蛋白质靶标的结合剂,成功命中了14个。在生成的1320个设计方案中,有354个经独立实验室验证有效,总成功率达到26.8%,是行业平均成功率(10%-15%)的两到三倍。在特定靶标(如RBX1和TNFα)上,其表现甚至超越了以往的人类专家或竞赛成果。

QClaude设计蛋白质与AlphaFold预测蛋白质结构有何本质区别?

AAlphaFold的任务是“给定蛋白质序列,预测其三维结构”,属于预测性质。而Claude的任务是“给定靶标蛋白名称,从零开始设计一个能结合它的全新蛋白质序列”,属于创造性质。前者是“看图说话”,后者是“命题作文”,后者在科学探索和药物研发上具有更大的主动性和应用潜力。

Q在这次实验中,人类操作员具体负责了哪些工作?

A人类操作员仅负责三件事:批准Claude访问网络和云服务器的权限、监控基础设施运行状态、以及将Claude生成并排序好的设计方案送至两家独立实验室(Adaptyv Bio和Twist Bioscience)进行合成与检测。整个设计过程,包括选择靶点、选用工具、运行模型、筛选优化和结果排序,完全由Claude自主完成,没有任何人类介入设计决策。

QClaude是如何实现自主蛋白质设计的?它使用了什么特殊工具吗?

AClaude并未发明新的专用工具,而是通过一份约1.6万词的详细提示词,系统整合了蛋白质工程师的工作流程知识。它自主调用并编排了一系列现有的开源蛋白质设计与结构预测工具(如RFdiffusion、ProteinMPNN、ESMFold2),根据任务需求组合成24种不同的工具组合,完成了从目标分析到最终设计的全流程。

QAnthropic对Claude的这项生物能力采取了什么安全措施?

A考虑到此类自主科研能力的“双重用途”风险(即既可用于有益研发,也可能被滥用),Anthropic已在公开发布给普通用户的Claude版本中,主动封锁了蛋白质设计等生物相关的高级能力,以防止潜在的不当使用。同时,该公司已将本次实验的提示词、数据和全部1440个设计模型开源,以促进科学界的透明研究和监督。

你可能也喜歡

大模型蒸馏时代结束:Fable 5.1改写API,彻底切断蒸馏后路

轰轰烈烈的大模型蒸馏时代面临终结。2026年9月2日,Anthropic发布了Claude Fable 5.1,对API规则进行了堪称史上最严格的反蒸馏改造。 核心改动是锁定了“思考块”——即AI在输出最终答案前的内部推理过程。此前,非法蒸馏者通过在多轮对话中篡改思考块前后的上下文(如系统提示或历史消息),能诱导模型泄露其底层逻辑。Fable 5.1引入了“上下文一致性验证”:若API检测到客户端传回的思考块与原始生成它的上下文有任何不一致,将直接报错拒绝服务。对于确需修改上下文的合法开发者,系统提供“非严格模式”,但在此模式下所有思考块将被静默删除,模型将失去先前推理记忆。 Anthropic此举事出有因。过去一年,工业级规模的非法蒸馏滥用猖獗,攻击者使用海量虚假账户和自动化脚本,通过“上下文注入”等技术“催眠”模型以提取核心能力。这导致了严重的“能力与安全脱钩”:蒸馏出的小模型继承了顶尖模型的智能,却绕过了耗费巨资构建的安全护栏与价值观对齐,可能被用于生成恶意代码或危险内容,构成巨大风险。 新规将分阶段执行,首先适用于2026年8月31日后创建的新API账户,现有老账户及消费端普通用户暂不受影响。受影响的开发者需调整代码逻辑,确保上下文完全一致或使用非严格模式。Anthropic明确,该机制未来将适用于所有账户。 新规也为合法开发者带来意外好处:由于强制上下文一致性,API服务器可实现高效的提示词缓存,从而大幅降低响应延迟和调用成本。 此次更新标志着行业分水岭,依靠套取API数据“走捷径”的训练方式将被彻底堵死。

marsbit23 分鐘前

大模型蒸馏时代结束:Fable 5.1改写API,彻底切断蒸馏后路

marsbit23 分鐘前

刚刚,Claude首次证明费马大定理,清华姚班大神出手了

近日,人工智能领域取得一项突破性进展。由清华姚班毕业生、哥伦比亚大学助理教授彭天翼带领的Anthropic研究团队,利用其AI模型Claude,在11天内完成了对费马大定理的首次端到端机器验证证明。 费马大定理是一个困扰数学界超过350年的著名数论难题,直到1995年才由英国数学家安德鲁·怀尔斯给出复杂的人类证明。此次Claude的工作并非发现新证明,而是将现有证明“形式化”——即把人类可读的数学论证转化为计算机可严格验证的代码。 整个证明过程基本由AI自主完成。Claude生成了约1300万行代码,定义了超过3万条可验证定理(其中2.95万条被最终采用),消耗了约600亿Token的计算资源。其生成的代码规模是目前全球最大数学定理库Mathlib的五倍以上,并仅依赖于三条最基础的数学公理。 成功的关键在于团队开发的全新平台“Prove2Me”。该平台通过定理任务树、陈述与证明分离、自然语言索引等技术,有效协调了几十个Claude智能体进行高效、并行的协作,克服了大模型常见的“健忘”和逻辑混乱问题,使大规模形式化证明成为可能。 这一成果获得了数学界的积极评价。有专家认为,这是现代数学文献自动形式化的重要一步,未来可用于检查现有数学成果中的错误,并验证AI生成的数学结论。该技术也展示了潜力:在后续测试中,仅用3个普通账号和3天时间,就完成了另一数论定理“维诺格拉多夫三素数定理”的形式化。 研究团队强调,AI的目标并非取代数学家,而是彻底改变数学工作的方式。通过提供强大的自动验证工具,AI有望终结数学证明中长期存在的“不确定性”,让数学家能更专注于创造性的思考,并将“附带机器可验证代码”可能成为未来数学论文的新标准。 此次突破标志着AI在深层次逻辑推理和复杂系统协作方面取得了显著进展,为数学及其他科学领域的自动化验证开启了新的可能性。

marsbit26 分鐘前

刚刚,Claude首次证明费马大定理,清华姚班大神出手了

marsbit26 分鐘前

Raoul Pal:为什么传统投资组合已然失效?

Raoul Pal指出,传统投资组合(包含债券、黄金、房地产、指数基金)在当今宏观环境下已然失效。其核心原因在于,全球经济增长高度依赖债务扩张,导致货币供应量以约每年8%的速度增长,加上日常通胀,投资者需要实现年化约11%的收益率才能维持购买力不缩水。 逐一评估主流资产:债券收益固定但无法对冲货币贬值;房地产抗贬值能力已大不如前;黄金能保值但难以创造新增财富;标普500指数在过去十年超级牛市中勉强达标。真正能持续超越11%收益基准的,只有科技资产与加密资产,因其遵循用户渗透的S型增长曲线,具备长期复利潜力。 传统分散配置失效,是因为这些资产现在都受同一宏观变量(流动性)驱动,不再提供真正的风险对冲。真正的资产配置不应只看标的数量,而应将资金集中于具有长期增长潜力的赛道。对于加密资产,底层公链作为基础设施,比押注单一应用更具确定性和增长空间。未来AI智能体作为经济参与者,将催生对可编程货币和链上结算的巨大真实需求。 投资者需正视风险:避免全仓单一资产、严禁使用杠杆。建议分层布局,保留部分传统资产以求安心,配置一部分资金于高成长性资产,并长期持有。最终,跑赢11%的基准线关乎的不仅是财富数字,更是获得人生选择权和财务自由的关键。

marsbit1 小時前

Raoul Pal:为什么传统投资组合已然失效?

marsbit1 小時前

交易

現貨
活动图片