OpenAI和Anthropic都要“自研芯片”,除了成本,更重要的是算力控制权

marsbit发布于2026-07-03更新于2026-07-03

文章摘要

据The Information报道,Anthropic正与三星洽谈定制AI芯片,并已启动自研芯片的早期开发工作,此举被视为追随OpenAI的类似布局。两家头部AI公司共同指向同一趋势:大模型竞争正从算法层面转向软硬件一体化的综合竞争。 文章指出,自研芯片的首要动机并非仅是降低成本,更是为了掌握核心算力的控制权。当前,AI计算高度依赖英伟达GPU,供应紧张和成本高企使算力成为核心生产资料。通过定制芯片,AI公司可以优化模型与硬件的协同设计,从而在推理速度、能耗和单位经济性上获得更大提升。专家分析认为,最大的效率提升空间来自模型、内核与硅片之间的跨层协同优化,而非单点改进。 然而,这并不意味着对英伟达的立刻替代。自研芯片从设计到部署周期漫长,且英伟达的CUDA生态和通用性优势依然显著。因此,自研芯片更可能作为一种技术备选和谈判筹码,用于特定、高负载的推理场景,形成对现有供应链的制衡。 这一动向也反映了全行业“算力自主权”竞赛的全面开启。从谷歌、亚马逊到Meta、微软,全球科技巨头均已深度布局自研AI芯片。对三星等代工厂而言,获得Anthropic的订单将有助于其在AI半导体领域扩大影响力。总体而言,大模型的竞争已延伸至对算力、资金和硬件栈的整体控制能力。

据The Information周四报道,Anthropic正与三星洽谈定制人工智能芯片事宜,并已启动自研人工智能芯片的早期开发工作。若该定制服务器芯片最终进入量产,这将成为Claude背后公司推进硬件自主化的重要一步。

这一动作被视为Anthropic追随OpenAI的信号。

OpenAI已更早推进定制AI芯片项目,并与芯片设计和制造伙伴合作,试图为ChatGPT等产品建设更独立,效率更高的计算基础设施。两家公司共同指向同一趋势,大模型公司正从单纯算法竞争,转向软硬件一体化竞争。

市场影响首先落在三条线上:英伟达等外部GPU供应商的议价环境,三星等代工厂在AI芯片订单中的机会,以及AI初创公司未来融资和上市节奏。

据巴伦财经报道,德银分析师近期建议OpenAI和Anthropic不应过久推迟IPO,原因之一正是自研芯片和算力基础设施需要巨额长期资本。

自研芯片首先是算力控制权问题

目前,训练和运行大模型需要大量高性能计算资源。AI计算市场高度依赖英伟达GPU架构,供需紧张使模型训练和推理成本维持高位。对OpenAI和Anthropic这样的模型公司而言,芯片不再只是采购项目,而是核心生产资料。

Anthropic的Claude模型需求在2026年显著增长。TradingKey报道称,Anthropic高管此前披露,公司年化收入已超过300亿美元,而2025年底约为90亿美元。业务扩张推动算力需求快速上升,也放大了外部芯片供应不确定性对公司运营的影响。

Anthropic目前仍依赖多种第三方芯片方案,包括Alphabet旗下Google设计的TPU,以及Amazon自研芯片。报道称,Anthropic还与Google和Broadcom达成长期TPU供应协议,该协议与其此前承诺的500亿美元美国计算基础设施投资计划相关。

这意味着,自研芯片并不等同于完全摆脱外部供应商。更现实的目标是掌握核心设计能力,形成技术备选项,并提升未来商业谈判中的筹码。

成本只是入口,软硬件协同才是关键

自研芯片最直接的理由是降低成本。通过定制ASIC,AI公司可以围绕自身模型架构优化计算流程,减少通用芯片中不必要的模块,从而提高能效。若Anthropic芯片成功流片并部署,报道称其可能显著降低API调用成本,并影响企业AI应用市场的定价结构。

但成本并不是唯一变量。SemiAnalysis创始人Dylan Patel在访谈中强调,AI效率提升的最大空间并不只来自更快芯片,而来自模型,内核和硅片之间的协同设计。他认为,单层优化可能带来两倍提升,但跨层协同可能带来远大于简单相乘的效果。

这解释了为什么OpenAI和Anthropic都在走向更深的硬件参与。模型架构并非天然适配所有芯片。Dylan Patel称,OpenAI模型更偏稀疏,Anthropic模型相对更稠密,两者在矩阵乘法单元尺寸、注意力机制结构、专家层形状等方面存在显著差异,这使得两家公司在硬件选择上天然倾向于不同方向。"实际上,按照OpenAI模型的发展方向,使用TPU对他们而言可能是糟糕的决策;而按照Anthropic和谷歌模型的发展方向,用GPU训练对他们而言同样可能是糟糕的决策。"他说。

换言之,自研芯片不只是把英伟达GPU替换成自己的芯片。真正目标是让模型从设计之初就能贴合底层硬件,从而改善推理速度,能耗,吞吐量和单位经济性。

对英伟达不是立刻替代,而是长期制衡

自研AI芯片从研发设计,流片验证,到最终量产部署,通常需要18至24个月。即便Anthropic与三星顺利达成合作,其自研芯片也很难在短期内实质性替代现有算力供应。

OpenAI则推进更早。TradingKey报道称,OpenAI选择与Broadcom和TSMC合作,计划在2026年下半年部署首款推理芯片。相比Anthropic,OpenAI在定制芯片路径上更主动,也更接近落地阶段。

大模型公司自研芯片的方向,确实指向降低对英伟达等供应商的依赖。但这并不意味着Nvidia的地位会被迅速削弱。Dylan Patel在访谈中指出,Nvidia GPU仍具有通用性优势,许多模型和开源生态本身就是围绕GPU优化的。他还提到,所谓CUDA护城河并不只是CUDA本身,而是大量下游模型和软件生态已经为英伟达硬件形态做了适配。如果模型的专家结构,隐藏维度和通信模式都更适合GPU,那么即便其他芯片具备优势,迁移也未必简单。

因此,自研芯片更像是建立第二条路线。OpenAI和Anthropic可能会继续使用GPU,TPU,Trainium等多种算力资源,同时把自研ASIC用于更明确,更稳定,更高频的工作负载,尤其是推理场景。

全行业“算力自主权”竞赛全面开启

OpenAI和Anthropic自研芯片的共同逻辑,可以概括为三点:降低长期算力成本,减少外部供应依赖,以及通过软硬件协同提升模型效率。

其中,第三点可能最关键。随着模型公司规模扩大,通用算力无法完全满足差异化架构需求。自研芯片让公司能够把模型设计,系统软件和底层硅片放在同一个优化框架内。

但方向已经清楚:大模型竞争正在从“谁的模型更强”,延伸到“谁能更好地控制算力,资金和硬件栈”。这也是OpenAI和Anthropic都走向自研芯片的真正原因。

Anthropic的探索并非孤例。从谷歌深耕十余年的TPU系列,到亚马逊专注训练场景的Trainium系列,再到Meta面向推理场景的MTIA系列,以及微软持续推进的Maia系列,头部科技公司均已在自研芯片赛道上深度布局。

对于三星而言,若能拿下Anthropic的芯片代工订单,将为其晶圆代工业务在AI领域的影响力带来重要提振。三星目前正与台积电等厂商激烈争夺先进制程客户,引入Anthropic这样具有高成长潜力的AI客户,有助于扩大其在AI半导体领域的版图。

本文来自微信公众号: 华尔街见闻 ,作者:赵颖

相关问答

QOpenAI和Anthropic自研AI芯片的主要原因是什么?

A主要原因有三点:首先是为了降低长期算力成本;其次是为了减少对外部供应商(如英伟达)的依赖,掌握算力控制权;最关键的是为了通过软硬件协同设计,让模型从设计之初就能贴合底层硬件,从而在推理速度、能耗、吞吐量和单位经济性上获得更大提升。

QAnthropic目前主要依赖哪些第三方的芯片方案?

AAnthropic目前依赖多种第三方芯片方案,包括Alphabet旗下Google设计的TPU,以及Amazon的自研芯片。此外,报道称Anthropic还与Google和Broadcom达成了长期的TPU供应协议。

Q自研AI芯片是否意味着会立刻替代英伟达的GPU?为什么?

A不会立刻替代。主要原因有:自研芯片从研发到量产部署通常需要18-24个月,周期较长;英伟达GPU具有通用性优势,其CUDA生态(包括大量适配GPU的模型和软件)构成了强大的护城河;因此,自研芯片更像是建立第二条路线,模型公司可能会继续使用多种外部算力资源,而将自研ASIC用于更明确、稳定和高频的工作负载(尤其是推理场景),以形成制衡。

Q除了OpenAI和Anthropic,还有哪些科技公司在布局自研AI芯片?

A多家头部科技公司已在自研AI芯片赛道上深度布局,包括:谷歌深耕十余年的TPU系列、亚马逊专注训练场景的Trainium系列、Meta面向推理场景的MTIA系列,以及微软持续推进的Maia系列。

Q三星若拿下Anthropic的芯片代工订单,对其业务有何意义?

A这对三星的晶圆代工业务有重要提振意义。三星目前正与台积电等厂商激烈争夺先进制程客户,引入Anthropic这样具有高成长潜力的AI客户,有助于扩大其在AI半导体领域的市场份额和影响力。

你可能也喜欢

Hyperliquid的合规之路:从无需许可到许可制HIP-3

Hyperliquid(基于HyperCore的去中心化交易基础设施)因其无需许可、用户自托管的特点,与美国针对期货交易的严格市场结构法律(涉及注册交易平台DCM、清算所DCO和经纪商FCM)存在根本冲突,因此一直对美国市场进行地理封锁。 为了解决此困境,Hyperliquid成立了政策中心(HPC),积极游说美国监管机构(CFTC、SEC),主张将Hyperliquid视为“中立基础设施”。其核心提议是:允许已受监管的实体(如经纪商、交易平台)在履行其原有KYC、市场监控等合规义务的前提下,利用Hyperliquid的底层技术(如HyperCore)来构建和运营产品,而非要求协议本身改变其无需许可的特性。 作为这一合规路径的实例,Hyperliquid已在测试网推出具备许可权限的HIP-3部署者功能。此类部署允许受监管实体创建仅对白名单用户(即已完成KYC的合规用户)开放的市场,并拥有对用户账户执行特定操作(如强制平仓)的权限,从而模仿传统金融中FCM的职责。尽管这些合规市场会形成独立的订单簿,但通过白名单做市商的桥梁作用,它们仍能共享Hyperliquid主市场的流动性。 总之,Hyperliquid的战略目标并非直接向美国用户开放其原生免KYC前端,而是通过提供工具,让合规机构能在其底层上构建符合美国法规的产品,从而为美国投资者提供间接参与其生态的合规通道,同时保持协议本身的中立性与开放性。

marsbit35分钟前

Hyperliquid的合规之路:从无需许可到许可制HIP-3

marsbit35分钟前

AI时代最大的政治经济学命题:机器人越来越能干,人类如何分享价值?

《经济学人》近期评论引发思考:中国在机器人、AI等尖端领域取得突破的同时,居民消费疲软、企业利润承压,这背后触及一个更深层的全球性命题——当机器(尤其是AI)越来越能替代人类劳动时,人类如何分享机器创造的价值? AI正在改写财富分配的底层逻辑。过去技术进步虽提升效率,但人仍是生产核心,生产率提升能转化为就业与工资增长。然而,AI首次大规模进入认知劳动领域,未来可能替代大量知识乃至决策工作,导致经济成长但直接参与创造的人减少。核心矛盾从“失业”转向“分配”:若劳动被机器替代,而新收入来源未建立,社会可能面临生产能力增强但大众购买力不足的困境。 当前全球已出现技术红利与大众收入传导的断点。美国科技巨头市值飙升,但劳动收入占GDP比重长期下降,财富向少数集中。中国同样面临挑战:虽在新能源、机器人等领域进步显著,但需打通“科技创新→企业盈利→居民收入→消费增长”的传导链条,解决收入预期不稳、社会保障不足等根本问题,让生产率红利惠及全社会。 未来可能的发展路径包括:传统资本主义(利润归资本,再分配靠税收)、国家资本主义(政府通过持股让全民间接分享收益),以及更具创新性的方式,如建立数字主权基金、全民持股或新型基本收入制度,让社会成员直接分享智能经济创造的增量价值。 对中国而言,最大优势不仅在于市场与产业链,更在于协调政策与长期发展的制度能力。未来的重点应是同步推进AI发展与收入分配改革、社保完善、职业再培训等,构建让普通人共享技术进步红利的机制。 AI时代的终极竞争,不仅是技术比拼,更是建立适应智能经济的新分配体系的竞赛。谁能率先让增长成果转化为广泛的社会福祉,谁就能掌握下一轮文明演进的话语权。

marsbit55分钟前

AI时代最大的政治经济学命题:机器人越来越能干,人类如何分享价值?

marsbit55分钟前

交易

现货
活动图片