輝達Groq LPX機架量產,SpaceX和Nebius成Vera CPU首批客戶

Nashnova编辑部
Published todayAbout 3 min read

英偉達宣佈Groq 3 LPX機架全面量產,SpaceX和Nebius成為首批客戶——這意味著英偉達200億美元收購Groq後,低延遲推理晶片正式進入商業化交付,GPU以外的第二條產品線開始落地。

01

Groq機架量產,到底在賣甚麼?

Groq 3 LPX機架每個集成256顆Groq 3晶片,定位是低延遲推理加速器(專門加速AI模型「給出回答」這一步,而非訓練模型)。
基準測試顯示推理速度達每秒3400個token,而OpenAI新推出的Ultrafast模式承諾每秒750個token。這意味著→ Groq在純速度上拉開了數量級差距。
Groq晶片的核心設計是在晶片內部集成500兆字節高速SRAM(一種直接焊在晶片上的超快記憶體),簡單來說= 數據不用跑遠路去取,延遲就降下來了。
02

SpaceX和Nebius打算怎麼用?

Nebius將成為全球首家同時部署Groq LPX機架與Vera Rubin GPU機架的AI雲端服務商,Groq機架與Vera CPU、Rubin GPU一同上線,預計今年稍後交付。
SpaceX計劃使用Vera CPU機架,單機架最多容納256顆Vera CPU,主要跑智能體AI(Agentic AI,即能自主執行多步任務的AI)等長時間運行的工作負載。
SpaceX旗下SpaceXAI還將用英偉達Vera Rubin NVL72系統發射Starmind人工智能衞星。這反映出英偉達的算力產品線已從數據中心延伸到太空場景。
03

不是取代GPU,那定位到底是甚麼?

英偉達高級總監哈里斯明確表態:「這不是要取代GPU,而是在正確的工作負載上使用正確的處理器、正確的價格。」
簡單來說= GPU負責「重活」(訓練和複雜推理),Groq負責「快活」(對延遲極度敏感的推理解碼階段)。兩條產品線各管一段。
這意味著→ 雲端服務商可以把低延遲能力單獨打包成高溢價服務層級,賣給對速度最敏感的客戶。
04

競爭對手在做甚麼?

AMD此前宣佈將機架級系統與Cerebras晶片整合,同樣瞄準低延遲推理賽道;Cerebras近期已完成上市。
英偉達此次Groq LPX量產,是對這一競爭格局的直接回應。這反映出低延遲推理正從「技術驗證」進入「搶客戶」階段。
Groq晶片由三星代工,英偉達GPU由台積電製造——兩條供應鏈並行,也分散了製造端的集中風險。
05

還有甚麼沒說清楚?

據The Information報道,英偉達對Vera CPU和Groq LPX機架的定價、規模及交付時間表均未披露。
部分伺服器廠商表示尚未收到相關定價信息或採購訂單。這意味著→ 商業化剛起步,實際出貨規模仍是未知數。
英偉達將於本周三發佈財報,Groq LPX的客戶採購規模與定價能否在財報中披露,是市場下一個關注焦點。

Content is for reference only, not financial advice.

輝達Groq LPX機架量產,SpaceX和Nebius成Vera CPU首批客戶 · nashnova