輝達200億美元收購Groq首款機櫃量產 今年將與Vera Rubin一同上線
記者黃仁杰/編譯
輝達(NVIDIA)昨(24)日宣布,Groq 3 LPX機櫃已進入全面量產,這也是公司去(2025)年以200億美元收購Groq相關資產後,首度將其技術正式商業化。

輝達資深總監Dion Harris表示,Groq 3 LPX將與Vera CPU及Rubin GPU一同部署在新型雲端業者Nebius的資料中心,預計今年稍晚正式上線。
輝達快速把Groq晶片導入量產,也反映低延遲AI推論的重要性持續提高。這類晶片主要用來縮短AI Agent產生回應的等待時間,尤其在程式碼生成等需要即時互動的應用中更為重要。
Harris表示,對提供AI Token服務的業者而言,更低的延遲也能讓雲端服務商推出價格更高的進階服務方案,滿足對反應速度要求更高的客戶。
200億美元收購後快速商業化
輝達去年12月以200億美元收購AI晶片新創Groq的部分資產,是公司歷來規模最大的收購案。
Groq架構的一大特色,是直接在晶片裸晶上整合500MB高速SRAM,希望降低資料必須頻繁往返外部記憶體造成的瓶頸。
Groq晶片由三星電子負責製造,輝達GPU則主要由台積電生產。
「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/
更多科技工作請上科技專區:https://techplus.1111.com.tw/
輝達此次推出的Groq 3 LPX機櫃,單一機櫃內整合256顆Groq 3晶片。根據Artificial Analysis測試數據,Groq 3 LPX每秒可輸出3,400個Token。
低延遲推論成新戰場 AMD、Cerebras也搶進
低延遲AI推論市場競爭也正快速升溫。
AMD今年稍早宣布,將把自家機櫃級系統與Cerebras晶片整合,同樣鎖定低延遲推論市場。
OpenAI近期公布的Ultrafast模式則宣稱可達每秒750個Token,並由Cerebras技術驅動。
不過,這類低延遲晶片並不是要取代GPU。
GPU仍是目前AI運算的主要核心,可以同時處理模型訓練與推論,也能因應不同模型與新技術;Groq這類晶片則主要鎖定推論流程中的「Decode」階段,也就是模型逐步生成Token的過程。
Harris表示,重點並不是取代GPU,而是「針對工作負載的不同部分,使用合適價格、合適的處理器」。
Groq與Vera Rubin分工 黃仁勳:程式碼工作負載四分之一交給Groq
輝達目前也正在加快Vera Rubin系統出貨,該平台今年稍早已進入生產。
今年3月發表Vera Rubin與Groq 3 LPX時,執行長黃仁勳曾預估,從目前Blackwell世代到新一代Vera Rubin系統,累計銷售額至2027年可達1兆美元。
黃仁勳當時也表示,未來針對程式碼相關AI應用,會把資料中心約四分之一的空間配置給Groq晶片。
他當時表示:「其餘的資料中心則全部都是Vera Rubin。」
輝達預計本週三(26)公布最新財報。
來源:CNBC
![]()





