HBM正在被重新定义

marsbit發佈於 2026-08-26更新於 2026-08-26

文章摘要

随着AI大模型需求爆发,算力瓶颈转向存储带宽,HBM高带宽内存成为AI硬件迭代关键。在HotChips2026大会上,三星和SK海力士披露了HBM4技术路线,其演进逻辑从以往提升DRAM速率和堆叠层数,转向Base Die逻辑工艺升级、混合键合3D堆叠、EMIB异构封装三大创新方向,标志着HBM从单一存储器件向“存储+逻辑+封装+IP+EDA”一体化系统转型。 HBM4不再聚焦存储颗粒,而是重构底部Base Die。三星采用4nm逻辑工艺,集成PHY和内存控制逻辑以优化信号完整性;SK海力士与台积电合作使用12nm工艺,注重量产稳定性和散热。这种差异化使供应链和设计复杂度大增,HBM需与逻辑代工厂深度协同,周期拉长。 封装路线走向多元化:SK海力士评估英特尔EMIB技术作为CoWoS的补充,以降低成本和突破产能限制;堆叠内部键合技术则从MR-MUF向混合键合过渡,后者能提升集成度和散热,但预计2027-2028年才能规模化。热管理成为高堆叠HBM的核心挑战,厂商已推出内置导热组件等解决方案。 此外,高速IP和3D EDA工具链成为新壁垒。高速IP需适配多工艺架构,资源被少数厂商垄断;3D异构EDA工具链的缺失使跨工艺协同仿真困难,设计流程割裂。一体化设计工具和兼容性IP对HBM4量产至关重要。 总之,HBM产业进入系统竞争时代,技术路线分化、新旧工艺共存,架构、封装、工艺和软硬件生态的协同能力将决定未来竞争格局。

随着AI大模型训练与推理需求持续爆发,算力芯片的性能瓶颈已从计算单元转向存储带宽,HBM高带宽内存成为制约高端AI硬件迭代的核心关键。在HotChips2026国际高端芯片技术大会上,全球两大存储龙头三星、SK海力士集中披露了HBM4下一代技术演进路线,打破了行业沿用多年的HBM迭代逻辑。

相较于过往单纯提升DRAM速率与堆叠层数,新一代HBM4架构全面转向Base Die逻辑工艺升级、混合键合3D堆叠、EMIB异构混合封装三大创新方向。技术迭代的背后,是HBM从单一存储器件向“存储+逻辑+封装+IP+EDA”一体化系统的转型。

从颗粒提速到系统优化,HBM的演进逻辑发生切换

在此前HBM3、HBM3E的迭代周期中,行业技术升级逻辑相对固定,核心优化集中在DRAM存储颗粒本身,通过提升单颗粒传输速率、增加堆叠层数、优化微凸点互联结构,实现整体带宽的稳步提升。在此体系下,底部Base Die仅承担简单的信号转接、电源分配与测试辅助功能,充当被动信号桥梁角色。工艺架构长期沿用成熟存储衍生工艺,无需大规模迭代,整个HBM产品的技术壁垒与产能瓶颈,完全集中在DRAM制造环节。

但随着AI算力需求指数级增长,传统迭代模式的边际效应快速递减。超高带宽场景下,单纯提升DRAM速率会带来严重的信号串扰、功耗激增、时序偏移等问题,二维平面的优化已经无法适配超大算力负载。针对这一行业痛点,本届HotChips2026大会上,三星与SK海力士同步释放全新技术思路,明确HBM4时代的核心突破点不再是存储颗粒,而是底层Base Die的系统性重构。

两大厂商在技术方案上形成明显差异化路线。三星在HotChips演讲中披露,其HBM4/HBM4E产品Base Die采用自家4nm逻辑工艺,CDie使用1cDRAM节点,引脚速率最高达到11.7Gbps,可向上拓展至13Gbps,单堆栈带宽可达3.3TB/s。通过逻辑工艺的高密度晶体管优势,Base Die可集成更高性能的PHY电路、信号纠错模块与电源管理单元,大幅优化高速信号完整性,解决超高带宽下的时序紊乱问题。与此同时,三星在架构设计中明确,将部分内存控制逻辑下沉至Base Die,有效释放GPU端的硅片面积,为算力单元扩容提供空间。

SK海力士则采用分工协作的迭代模式,选择与台积电合作,Base Die采用台积电12nm逻辑工艺,相较于三星的全自研逻辑架构,SK海力士的方案更注重量产稳定性,通过优化Base Die的供电网络与热传导结构,适配12层乃至16层超高堆叠架构的散热与负载需求。两种路线的差异化布局,意味着HBM4的Base die内部逻辑架构不再统一,不同厂商的产品在工艺、性能、适配场景上形成天然差异,为后续供应链适配与芯片设计迭代增加了全新难度

将Base Die切换逻辑工艺带来多重收益。逻辑工艺可以实现更高晶体管密度,PHY电路的信号完整性、功耗控制得到优化,能够承载HBM4翻倍之后的2048位I/O位宽。同时Base Die富余的芯片面积,给近存计算带来硬件空间,HBM不再仅仅作为数据容器,可以在存储内部完成简单的数据预处理,缓解冯・诺依曼架构的数据搬运压力。但代价同样显著,HBM不再是存储厂可以完全闭环完成的产品,逻辑代工产能、IP设计能力、跨工艺协同仿真,全部变成HBM量产的约束条件。DRAM厂商需要和逻辑代工厂深度协同,设计、验证、流片周期被拉长,供应链复杂度成倍上升。

多重先进封装路线并行

HotChips2026释放的另一个关键信号,HBM的系统集成封装路线正在走向多元化,台积电的CoWoS不再是唯一解,混合封装方案登上舞台,同时堆叠内部键合技术向混合键合3D堆叠过渡。

SK海力士在演讲中确认,正在评估英特尔EMIB嵌入式硅桥技术,用于HBM4与算力芯片之间的2.5D系统集成。传统CoWoS依靠整块大面积硅中介层完成GPU与HBM之间全部信号互连,性能优异,但中介层成本高昂,同时受光刻机光罩尺寸限制,产能扩张难度大,全球CoWoS的产能长期处于供不应求状态,头部客户优先锁定产能,其余厂商拿产线需要长时间排队。EMIB放弃整片硅中介层,只在芯片信号交互的局部嵌入微型硅桥,有机基板承担大部分布线,局部硅桥完成高密度高速信号传输。这套方案可以降低封装成本,突破光罩尺寸限制,实现更大规模多芯片集成,谷歌TPU已经将EMIB纳入下一代方案选型清单。

但EMIB并不意味着直接替代CoWoS。EMIB的局部硅桥在极高密度信号场景下,信号损耗、电源完整性依旧和全硅中介层存在差距。SK海力士的定位,是把EMIB作为重要补充路线,而不是全盘替代。高端训练芯片依旧会优先沿用CoWoS,中高端推理、大算力加速器可以使用EMIB方案缓解封装产能压力,形成双路线并行的局面。

而HBM堆叠内部,也就是多层DRAMDie之间的键合技术,正处在从MRMUF向混合键合过渡的周期。现阶段HBM4量产版本,主流依旧使用MRMUF、TCNCF热压键合方案,依靠微凸点实现层间互连。但随着堆叠层数冲向16层,微凸点的间距、热阻、功耗逐步抵达物理极限。混合键合(HybridBonding)相较于MR-MUF工艺,不仅能使核心芯片厚度增加24%,将TSV间距缩小至18微米以下,还能在增加堆叠层数的情况下,将热阻大幅降低35%,预计该技术最早落地于HBM5,面向16到20层及以上超高堆叠。

不过,混合键合目前还处在小批量验证阶段,良率控制、设备成本、薄晶圆处理都存在挑战,2026年不会大规模商用,行业普遍预期20272028年HBM4E迭代版本、HBM5世代才会迎来混合键合规模化落地。

这也造就了当前HBM产业非常特殊的技术过渡形态:新一代HBM4产品,外部系统集成率先开启EMIB异构封装的多元化探索,缓解高端封装产能压力;内部DRAM堆叠依旧坚守MRMUF成熟热压工艺保障量产稳定性,混合键合仅做前置预研布局。多重技术路线同步推进、新旧工艺交叉并存,大幅放大了现阶段HBM4技术选型的不确定性。

除此之外,热管理正式成为超高堆叠HBM绕不开的核心卡点。16层堆叠架构让HBM整体热负荷大幅攀升,热量堆积会直接导致带宽降频、性能无法满跑。针对这一痛点,两家厂商已拿出差异化解决方案:SK海力士推出IHBM内置导热组件方案,通过在HBM的D2D PHY区域嵌入高导热且电绝缘的冷却组件,构建专用散热路径,可额外降低30%以上的热阻,提升系统的运行稳定性;三星则为远期HBM5产品规划铜散热通路设计,从硬件结构层面破解超高堆叠的散热难题。可以明确的是,未来高堆叠HBM产品的性能上限,不再单纯取决于带宽与速率参数,而是由热管理能力直接决定。

IP与3D EDA成为HBM4隐形核心门槛

如今,HBM4的核心壁垒不只是制造、封装,而是已经延伸至高速IP与异构EDA工具链两大软实力环节,成为当前产业最容易被忽视、却最关键的卡点。随着HBM4接口速率突破9Gbps、IO位宽翻倍扩容,高速PHY、SerDes接口IP的设计难度呈指数级上升。

高速IP并非简单的电路设计,需要深度适配DRAM颗粒特性、Base Die逻辑架构、封装布线结构,完成信号完整性、电源完整性的联合仿真调试。当前全球成熟量产级HBM4高速IP资源高度集中,少数海外头部厂商凭借多年流片积累,垄断了主流算力芯片的IP配套市场。对于中小算力设计企业与新兴供应链厂商而言,无法获取成熟高速IP,就无法适配HBM4架构,直接形成严苛的行业准入壁垒。

与此同时,3D异构EDA工具链的短板,进一步放大了HBM4的落地难度。HBM4属于典型的多工艺、多裸片异构集成系统,逻辑基底、存储堆叠、硅桥/中介层封装分属不同工艺体系,传统二维分立EDA工具无法完成跨裸片、跨工艺的协同仿真。在三维堆叠场景下,电学、热学、力学效应相互耦合,单一环节的仿真偏差,都会导致整体设计收敛失败。

当前行业主流设计流程存在明显割裂问题,前端逻辑设计、中端物理实现、后端封装仿真数据无法互通复用,迭代成本极高。HotChips2026明确指出,HBM4的规模化落地,高度依赖一体化3DIC协同设计工具链,可实现设计、工艺、封装、多物理场仿真全流程联动。EDA工具的适配能力、高速IP的调试兼容性,直接决定HBM4的量产良率与性能上限,也是现阶段中小厂商难以突破的核心技术壁垒。

整体来看,本届大会完整勾勒出HBM产业的全新进化路径:告别传统单点硬件迭代模式,迈入架构、封装、工艺、软硬件生态协同升级的系统竞争时代。三星、SK海力士的差异化技术路线,打破了行业长期的标准化格局,新旧工艺长期共存、场景化技术分层、系统能力决胜,将成为未来2-3年HBM赛道的核心发展常态,改写AI存储产业的竞争规则。

本文来自微信公众号 “半导体产业纵横”(ID:ICViews),作者:子皓

相關問答

Q根据文章,HBM4的技术演进与前几代相比,其核心突破点发生了什么根本性变化?

AHBM4的核心突破点不再是单纯提升存储颗粒(DRAM)的传输速率和堆叠层数,而是转向对底层基础芯片(Base Die)的系统性重构。HBM4通过将Base Die升级至先进的逻辑工艺(如三星采用4nm,SK海力士采用台积电12nm),并集成更高性能的电路和部分控制逻辑,从单一的存储器件向“存储+逻辑+封装+IP+EDA”一体化系统转型。

Q文章中提到HBM4的系统集成封装路线正在走向多元化,具体有哪两种主要方案?它们各自有何特点和定位?

A主要有两种方案:台积电的CoWoS和英特尔的EMIB。CoWoS依靠整块大面积的硅中介层进行高密度互连,性能优异但成本高昂且产能受限,主要面向高端AI训练芯片。EMIB则只在芯片信号交互的局部嵌入微型硅桥,其余布线由有机基板完成,优点是能降低成本和突破光罩尺寸限制,定位为中高端推理芯片或大算力加速器的补充路线,以缓解高端封装产能压力。

Q关于HBM堆叠内部的键合技术,当前主流是什么?其未来发展方向是什么?文中提到的混合键合面临哪些挑战?

A当前HBM4量产版本的主流键合技术是微凸块(如MR-MUF)热压键合。未来发展方向是向混合键合过渡。混合键合能缩小间距、降低热阻、支持更高堆叠层数(如16-20层),预计在HBM4E或HBM5世代规模化落地。但目前其挑战在于仍处小批量验证阶段,良率控制、设备成本和高成本的薄晶圆处理技术都是待突破的难点。

Q文章指出,除了制造和封装,HBM4还有哪两大“软实力”环节成为核心壁垒?它们具体带来了哪些挑战?

AHBM4的两大“软实力”核心壁垒是高速IP与异构EDA工具链。挑战在于:1. 高速PHY等IP设计难度指数级上升,且需要深度适配DRAM、Base Die和封装结构,成熟IP资源被少数海外厂商垄断,形成了行业准入壁垒。2. 3D异构EDA工具链存在短板,传统二维分立工具无法有效完成跨裸片、跨工艺的协同仿真,导致设计流程割裂、迭代成本高,一体化3DIC协同设计工具的缺失直接影响HBM4的量产良率和性能上限。

Q针对超高堆叠HBM带来的热管理难题,三星和SK海力士分别提出了什么解决方案?

A针对热管理难题,两家公司提出了差异化解决方案:SK海力士推出了iHBM方案,在HBM的D2D PHY区域嵌入高导热且电绝缘的冷却组件,构建专用散热路径,号称可额外降低30%以上热阻。三星则为远期的HBM5产品规划了铜散热通路设计,从硬件结构层面系统性解决散热问题。文章强调,未来高堆叠HBM的性能上限将直接由其热管理能力决定。

你可能也喜歡

CryptoQuant的比特币“牛市评分”指数飙升至80,但83,000美元关口将成为真正考验

加密货币分析公司CryptoQuant的“牛市评分”指数近期从30飙升至80,创下自2025年10月以来的最高值,也是今年最快的市场情绪转变。该指数用于评估比特币是否进入新阶段,其十个基础指标中有八个(涵盖市场需求、投资者收益、网络活动和流动性)目前均发出看涨信号。 比特币价格在过去十多天上涨近25%,短暂突破81,000美元后回落至79,000美元附近。同时,自2025年10月初以来,比特币在现货和期货市场的需求首次同步增长,这被视为比单一需求来源更强劲的积极信号。 美国现货比特币ETF的资金流入证实了这一趋势:截至8月21日当周,净流入约19亿美元,为2025年10月以来最高。 然而,CryptoQuant对确认牛市持谨慎态度。该公司研究人员认为,比特币需要实现周收盘价稳定在83,000美元以上(接近其365日移动平均线),才能确认长期市场趋势的改善。在此之前,当前上涨仅被视为潜在新周期的“初始阶段”,而非确认。 这一转变与年初形成鲜明对比,当时由于市场压力,“牛市评分”指数曾跌至20。这也不同于该公司单独的“牛熊周期”指标(该指标已于5月转绿),显示出CryptoQuant目前正使用多种链上指标综合判断比特币的周期位置。

cryptonews.ru4 分鐘前

CryptoQuant的比特币“牛市评分”指数飙升至80,但83,000美元关口将成为真正考验

cryptonews.ru4 分鐘前

交易

現貨
活动图片