标签: PIM

0

把计算搬进内存:三星PIM能否绕开AI芯片的“内存墙”

三星在 Hot Chips 2026 展示了基于 LPDDR5X 的 PIM 方案,在16个DRAM Bank旁布置乘加计算单元,利用芯片内部614 GB/s的并行带宽执行低精度矩阵运算。它针对的并非算力不足,而是大模型推理中权重反复搬运造成的带宽、能耗和成本压力。工作硅片与性能数据说明PIM正在从概念验证走向系统验证,但缓存一致性、任务切换、内存映射和软件适配仍决定着它能否进入通用计算平台。