三星研发 LPDDR-PIM 内存 端侧 AI 处理速度提升约 2.3 倍

Samsung 宣布全球首次开发出针对移动端等端侧 AI 设备的下一代内存 LPDDR-PIM,将运算功能整合至移动内存之中,声称能够有效提升 AI 处理速度并同时降低功耗。Samsung 相关负责人近日于美国斯坦福大学举行的半导体学术会议 Hot Chips 2026 上,公开 LPDDR5X-PIM 的结构、规格及验证结果。该产品本月初在 FMS 2026 内存会议上取得下一代内存奖项,这次则是首次对外披露详细规格。

PIM 技术通过在内存内嵌入运算单元,使部分运算能够直接在内存内部完成。在传统架构下,内存所储存的数据须先传送至中央处理器或图形处理器进行运算,再将结果传回内存。采用 PIM 之后,相对简单的运算可在内存内部处理,减少 AI 运作中主要瓶颈之一的数据搬运,兼顾速度与功耗表现。

LPDDR5X-PIM 处理速度较普通版本快 2.3 倍

Samsung 以参数规模达 80 亿的 Meta 开源 AI 模型 Llama 3.1 为测试对象,结果显示 LPDDR5X-PIM 的处理时间为 5.4 秒,较普通 LPDDR5X 的 12.3 秒快约 2.3 倍。每秒令牌处理量达到 81.3 TPS,为现有产品 27 TPS 的 3 倍。这组数据表明,内存内运算技术在实际 AI 推理场景中具备明显的性能优势。

事实上,Samsung 早在 2021 年已公开将 PIM 应用于高频宽内存的 HBM-PIM 技术,并完成开发验证。这次则选择将 PIM 应用于智能手机等移动设备广泛使用的低功耗 LPDDR 内存。公司方面判断,随着 AI 模型日益小型化及高效化,并非所有 AI 设备都需要 HBM。

端侧 AI 趋势扩大带动 LPDDR-PIM 应用前景

相关负责人表示,AI 支持的标准化内存方案虽然以 HBM 为主,但随着近期大型语言模型朝向小型化、高效化发展,HBM 未必始终是最佳选择,因此开发兼具高频宽与低功耗的 LP-PIM。随着生成式 AI 直接在智能手机或个人电脑等设备上运行的端侧 AI 趋势扩大,LPDDR-PIM 的应用前景亦同步增长,原因是电力及空间受限的移动设备既要提升 AI 运算性能,同时需要降低功耗。

在兼容性方面,该产品采用与通用 LPDDR 相同的阵列设计,无需大幅改动系统即可使用。Samsung 目前正提供软件开发工具包及模拟器等资源,推动相关生态建设。继 LPDDR5X-PIM 之后,Samsung 已启动 LPDDR6-PIM 的标准化工作。以 HBM 为中心的 AI 内存竞争正向智能手机及 PC 等端侧领域扩展,内存正由数据存储装置朝向直接参与运算的方向演进。

项目 规格
产品名称 LPDDR5X-PIM
技术类型 LPDDR 内存内运算(PIM)
Llama 3.1 处理时间 5.4 秒
普通 LPDDR5X 处理时间 12.3 秒
速度提升 约 2.3 倍
LPDDR5X-PIM 吞吐量 81.3 TPS
普通 LPDDR5X 吞吐量 27 TPS
测试模型 Meta Llama 3.1(80 亿参数)
下一阶段 LPDDR6-PIM 标准化

利益声明:本文包含合作商户产品链接,如你通过链接购买,TechRitual 可能获得佣金收入,但不影响产品评价及推荐。详情请参阅隐私政策

原创内容
本文是 TechRitual 原创内容的简体中文版本。
Stein Yep
Stein Yep