三星Hot Chips首发LPDDR5X-PIM内存,端侧AI推理速度提升三倍

首页 / AI资讯 / 泛AI领域

0:00
0:00
1x
定时

AI芯片的竞争正在从GPU算力延伸到数据搬运效率。8月25日,三星电子在美国斯坦福大学举行的Hot Chips 2026半导体会议上,首次公开了LPDDR5X-PIM内存的详细结构、规格与验证结果,这款全球首创的端侧AI内存,直接把计算单元塞进了移动内存芯片内部。

全球首创LPDDR-PIM,把计算塞进内存芯片

PIM是Processing In Memory的缩写,即内存内运算技术。传统架构中,内存只负责存储数据,计算必须由CPU或GPU完成,GPU反复从内存读取数据、执行计算、再把结果写回内存,数据在芯片与内存之间的来回搬运成为AI运行的主要性能瓶颈之一。PIM技术则把部分运算单元直接嵌入内存芯片,简单计算就近完成,大幅缩短数据搬运距离,从而提升速度并降低功耗。

三星此次展示的LPDDR5X-PIM,是低功耗内存LPDDR与PIM技术的结合。设计上,每16个DRAM bank放置一个PIM块,共16个计算块,每个bank可同时执行计算。产品容量16GB,PIM带宽高达614GB每秒,是普通DRAM 76.8GB每秒带宽的8倍。本月初该产品刚在FMS 2026内存会议上斩获下一代内存奖项,但详细参数直到这次Hot Chips才正式披露。

Hot Chips是全球半导体领域最高规格的学术会议之一,各大芯片厂商都会在此披露下一代产品的核心技术细节。三星选择在这个舞台上首发LPDDR5X-PIM的详细规格,本身就是技术自信的体现。从概念验证到公开完整架构与实测数据,PIM技术正在从实验室走向商业化验证的关键一步。

Llama 3.1实测提速三倍,端侧AI看到新解法

性能验证在真实AI环境完成。三星将普通LPDDR5X与LPDDR5X-PIM分别连接到自研的端侧AI加速器系统级芯片上,运行Meta开源大模型Llama 3.1 8B。结果显示,LPDDR5X-PIM完成处理仅需5.4秒,而普通LPDDR5X需要12.3秒,速度快了约2.3倍;每秒令牌处理量达到81.3,是普通LPDDR5X每秒27个令牌的3倍。也就是说,在不更换模型、不更换处理器的前提下,仅仅改进内存架构,端侧AI推理速度就能实现显著提升。

三星强调,这一成果来自在真实流片芯片上的验证,而非理论推演。事实上,三星早在2021年便公布了面向高带宽内存的HBM-PIM技术并完成开发验证,此次将PIM落地到智能手机等移动设备广泛采用的LPDDR低功耗内存,正是顺应大语言模型向小型化、高效化演进的趋势。相关负责人指出,虽然HBM是目前AI内存的标准方案,但并非所有场景都非它不可,LPDDR-PIM兼具高带宽与低功耗,为端侧AI开辟了新的可能。

兼容现有系统,商业化门槛大幅降低

技术领先之外,三星在产品设计上着重考虑了商业化落地。LPDDR5X-PIM采用地址对齐模式AAM,使其能够与现有的DRAM内存控制器协同工作,无需全面改造现有系统架构。同时,产品沿用与通用LPDDR相同的阵列设计,符合JEDEC封装标准,现有LPDDR5系统可直接使用,大幅降低了采用PIM技术的前期投入。

生态建设也在同步推进。三星正在提供软件开发工具包、模拟器等资源,帮助开发者为PIM架构优化应用。继LPDDR5X-PIM之后,公司已启动LPDDR6-PIM的标准化工作,目标是把PIM从专属技术扩展为多家系统厂商可用的标准内存技术。这意味着PIM不再只是三星的独门武器,而是有望成为整个行业的通用基础设施。

从行业趋势看,端侧AI的爆发正在改变内存的游戏规则。大模型从云端走向手机与PC,推理任务对内存带宽与功耗提出更高要求,而LPDDR正是移动设备的内存主力。PIM让内存参与计算,等于在有限的空间与功耗预算内变相增加了AI算力,这种思路对功耗敏感的边缘设备尤为关键。随着Llama等开源小模型在终端普及,端侧推理的算力瓶颈正在倒逼内存架构创新。

从HBM到LPDDR,AI内存竞争扩散至端侧战场

三星LPDDR-PIM的亮相,正值AI内存市场竞争格局剧变之际。内存占AI加速器成本的比例,已从2024年第一季度的52%升至2025年第四季度的63%,HBM的高成本与高功耗让业界开始寻找替代方案。在同一个Hot Chips 2026舞台上,SK海力士展示了面向下一代超高层HBM的混合键合技术与散热增强技术iHBM,美光则亮出CXL方案,中国长鑫存储等厂商也在加速追赶。

这场竞争的深层逻辑,是AI芯片竞争进入新阶段。行业人士指出,过去比拼的是GPU能跑多快,现在更关键的是数据如何高效搬运和处理。随着端侧AI趋势不断扩展,生成式AI直接在智能手机、PC等终端运行,电力与空间受限的移动设备亟需在提升AI算力的同时严控功耗,内存正从单纯的数据存储设备,进化为直接参与运算的关键组件。当算力不再只是显卡的专利,内存巨头们正在用PIM技术改写AI芯片竞争的版图。

素材来源:新浪财经、Seoul Economic Daily、BusinessKorea、快科技 发布时间:2026-08-27