标签: AI推理

0

16万颗昇腾950DT计划背后:中国AI算力竞争正在从“单卡性能”转向系统工程

9月4日,多家媒体援引彭博消息称,DeepSeek计划在内蒙古一座大型数据中心部署至少16万颗华为昇腾950DT,用于大模型推理。如果最终按这一规模落地,它会成为已知规模最大的昇腾AI芯片集群之一。报道同时称,DeepSeek仍计划在模型训练阶段继续使用英伟达GPU,昇腾950DT更多承担推理侧工作。DeepSeek和华为截至报道发布时均未公开确认这一采购计划,因此具体数量、建设周期和上线节奏仍应以企业后续披露为准。

0

把计算搬进内存:三星PIM能否绕开AI芯片的“内存墙”

三星在 Hot Chips 2026 展示了基于 LPDDR5X 的 PIM 方案,在16个DRAM Bank旁布置乘加计算单元,利用芯片内部614 GB/s的并行带宽执行低精度矩阵运算。它针对的并非算力不足,而是大模型推理中权重反复搬运造成的带宽、能耗和成本压力。工作硅片与性能数据说明PIM正在从概念验证走向系统验证,但缓存一致性、任务切换、内存映射和软件适配仍决定着它能否进入通用计算平台。