SK海力士定制HBM推理性能最高提升5.15倍
nashnova research
SK海力士在SEMICON Taiwan上披露,其定制HBM架构可将大模型推理性能提升最高5.15倍——核心做法是把计算直接放进存储芯片内部,减少数据来回搬运的开销。
这个架构到底改了什么?
SK海力士将计算功能直接集成到HBM的基础芯片(base die,整个芯片堆叠最底层的那块芯片)中。
这意味着→ 数据不再需要从存储芯片搬到处理器再搬回来,计算就在数据旁边完成。
用大白话说= 以前是"把货搬到工厂加工再搬回仓库",现在是"直接在仓库里装了一条生产线"。
为什么推理场景特别需要这种改变?
万亿参数大语言模型和智能体AI(能自主规划、连续执行多步任务的AI系统)运行时,数据搬运开销已成为核心瓶颈。
这意味着→ 模型越大、推理链越长,传统架构里"数据跑来跑去"吃掉的时间和功耗占比就越高。
5.15倍的提升幅度说明,在这类场景下,瓶颈不在算力本身,而在数据搬运效率。
离真正量产还有多远?
SK海力士在SEMICON Taiwan上发布了上述信息,但具体技术细节和量产时间表尚未完整披露。
这反映出该架构目前仍处于早期展示阶段,从演示到规模交付之间还有距离。
用大白话说= 方向已经亮出来了,但"什么时候能买到"这个问题还没有答案——这也是判断SK海力士定制HBM竞争力的关键节点。
市场有风险,内容仅供研究参考,不构成投资建议。