英伟达Groq LPX机架量产,SpaceX和Nebius成Vera CPU首批客户
Nashnova编辑部
英伟达宣布Groq 3 LPX机架全面量产,SpaceX和Nebius成为首批客户——这意味着英伟达200亿美元收购Groq后,低延迟推理芯片正式进入商业化交付,GPU之外的第二条产品线开始落地。
Groq机架量产,到底在卖什么?
Groq 3 LPX机架每个集成256颗Groq 3芯片,定位是低延迟推理加速器(专门加速AI模型"给出回答"这一步,而非训练模型)。
基准测试显示推理速度达每秒3400个token,而OpenAI新推出的Ultrafast模式承诺每秒750个token。这意味着→ Groq在纯速度上拉开了数量级差距。
Groq芯片的核心设计是在芯片内部集成500兆字节高速SRAM(一种直接焊在芯片上的超快内存),用大白话说= 数据不用跑远路去取,延迟就降下来了。
SpaceX和Nebius打算怎么用?
Nebius将成为全球首家同时部署Groq LPX机架与Vera Rubin GPU机架的AI云服务商,Groq机架与Vera CPU、Rubin GPU一同上线,预计今年晚些时候交付。
SpaceX计划使用Vera CPU机架,单机架最多容纳256颗Vera CPU,主要跑智能体AI(Agentic AI,即能自主执行多步任务的AI)等长时间运行的工作负载。
SpaceX旗下SpaceXAI还将用英伟达Vera Rubin NVL72系统发射Starmind人工智能卫星。这反映出英伟达的算力产品线已从数据中心延伸到太空场景。
不是替代GPU,那定位到底是什么?
英伟达高级总监哈里斯明确表态:"这不是要替代GPU,而是在正确的工作负载上使用正确的处理器、正确的价格。"
用大白话说= GPU负责"重活"(训练和复杂推理),Groq负责"快活"(对延迟极度敏感的推理解码阶段)。两条产品线各管一段。
这意味着→ 云服务商可以把低延迟能力单独打包成高溢价服务层级,卖给对速度最敏感的客户。
竞争对手在做什么?
AMD此前宣布将机架级系统与Cerebras芯片整合,同样瞄准低延迟推理赛道;Cerebras近期已完成上市。
英伟达此次Groq LPX量产,是对这一竞争格局的直接回应。这反映出低延迟推理正从"技术验证"进入"抢客户"阶段。
Groq芯片由三星代工,英伟达GPU由台积电制造——两条供应链并行,也分散了制造端的集中风险。
还有什么没说清楚?
据The Information报道,英伟达对Vera CPU和Groq LPX机架的定价、规模及交付时间表均未披露。
部分服务器厂商表示尚未收到相关定价信息或采购订单。这意味着→ 商业化刚起步,实际出货规模仍是未知数。
英伟达将于本周三发布财报,Groq LPX的客户采购规模与定价能否在财报中披露,是市场下一个关注焦点。
Content is for reference only, not financial advice.