SK海力士定制HBM推理性能最高提升5.15倍

nashnova research
今天发布阅读约 1 分钟

SK海力士在SEMICON Taiwan上披露,其定制HBM架构可将大模型推理性能提升最高5.15倍——核心做法是把计算直接放进存储芯片内部,减少数据来回搬运的开销。

01

这个架构到底改了什么?

SK海力士将计算功能直接集成到HBM的基础芯片(base die,整个芯片堆叠最底层的那块芯片)中。
这意味着→ 数据不再需要从存储芯片搬到处理器再搬回来,计算就在数据旁边完成
用大白话说= 以前是"把货搬到工厂加工再搬回仓库",现在是"直接在仓库里装了一条生产线"。
02

为什么推理场景特别需要这种改变?

万亿参数大语言模型和智能体AI(能自主规划、连续执行多步任务的AI系统)运行时,数据搬运开销已成为核心瓶颈
这意味着→ 模型越大、推理链越长,传统架构里"数据跑来跑去"吃掉的时间和功耗占比就越高。
5.15倍的提升幅度说明,在这类场景下,瓶颈不在算力本身,而在数据搬运效率。
03

离真正量产还有多远?

SK海力士在SEMICON Taiwan上发布了上述信息,但具体技术细节和量产时间表尚未完整披露
这反映出该架构目前仍处于早期展示阶段,从演示到规模交付之间还有距离。
用大白话说= 方向已经亮出来了,但"什么时候能买到"这个问题还没有答案——这也是判断SK海力士定制HBM竞争力的关键节点。

市场有风险,内容仅供研究参考,不构成投资建议。

SK海力士定制HBM推理性能最高提升5.15倍 · nashnova