原标题:《Samsung's Processing-in-Memory (PIM)》 评分: 225 | 作者: ingve 💭 把 CPU 塞进内存里,软件和散热就不用管了? 🎯 讨论背景 Samsung 讨论的 Processing-in-Memory (PIM) 是把部分计算逻辑放进 DRAM、LPDDR5 或 HBM2(高带宽内存)这类内存模块里,让内存自己做一部分运算,目标是减少 CPU/GPU 与内存之间的数据搬运。评论里不断提到 Hot Chips(芯片架构会议)和 ISCA(计算机体系结构顶会),说明这条路线早就有人研究过,只是这次又被 AI 推理的带宽压力重新推上台面。讨论的核心背景是 LLM、attention、KV cache、SIMD 和 NUMA 这些问题:一边是带宽和能耗,一边是虚拟内存、OS 支持、散热与安全模型的现实约束。很多人把它看成“把算力塞进内存”是否真的能落地的问题,而不只是另一次漂亮的架构演示。 📌 讨论焦点 适用场景很窄,更像专用加速器 很多评论认为 PIM 只适合数据依赖高度规则、能一次处理大块数据的任务,比如 streaming、向