(記者陳郁柔綜合外電報導)財經網站CNBC報導,AI晶片龍頭輝達(NVIDIA)周一宣布,Groq 3 LPX機架系統已全面進入量產,代表輝達去年與Groq達成技術授權及人才延攬協議後,相關技術進一步邁向商業化。外媒先前報導,這項交易規模約達200億美元。首批系統將部署於AI雲端服務商Nebius,預計今年稍晚正式上線。
Groq 3 LPX是輝達Vera Rubin平台的一環,主要鎖定低延遲AI推論市場,將與Vera CPU及Rubin GPU協同運作。隨著生成式AI逐漸朝能自主推理、執行任務的AI代理(AI Agent)發展,模型可能需要經過數百甚至數千次推論步驟,詞元(token)生成速度也成為影響AI回應效率的重要關鍵。
對雲端服務業者而言,更低的推論延遲也意味著新的商業機會。針對程式編寫及AI代理等高度重視即時反應的應用,業者可提供速度更快的高階推論服務,並向要求更高效能的企業及開發者收取較高費用。
在硬體架構方面,Groq 3 LPU採用大量高速靜態隨機存取記憶體(SRAM),每顆晶片內建500MB SRAM,藉此降低資料存取造成的延遲。根據輝達公布的規格,每座Groq 3 LPX機櫃整合256顆LPU,合計提供128GB SRAM及每秒40PB的SRAM頻寬。
供應鏈方面,Groq 3 LPU與輝達既有GPU採取不同晶圓製造布局。中央社今年3月於輝達GTC大會現場報導,輝達執行長黃仁勳宣布Groq 3推論晶片交由三星電子代工,並規劃今年下半年出貨;至於Rubin等輝達高階GPU產品,晶圓製造則主要仰賴台積電(2330)。三星與台積電分別在輝達不同AI晶片產品線中扮演重要製造角色。
效能方面,輝達表示,Groq 3 LPX在Artificial Analysis測試中執行Gemma 4 31B模型,在10萬詞元上下文條件下,單一使用者輸出速度超過每秒3,400個詞元,主打需要大量即時運算的AI代理應用。
低延遲AI推論市場競爭也持續升溫。超微(AMD)今年7月宣布與AI晶片業者Cerebras合作,推出超低延遲、高吞吐量AI推論方案;OpenAI本月推出的GPT-5.6 Sol Ultrafast模式也由Cerebras提供算力,標榜大幅提升詞元生成速度,顯示AI晶片戰場正從過去高度著重模型訓練效能,逐步延伸至推論速度與使用者體驗。
隨著AI代理應用快速成長,輝達透過Groq技術補強低延遲推論能力,也讓其AI晶片版圖進一步擴大。市場接下來將聚焦輝達周三公布的最新財報,以及公司對AI晶片需求、資料中心業務與後續產品布局的展望。
※ 提醒投資人,投資一定有風險,投資有賺有賠,申購前應詳閱公開說明書,學習正確的投資觀念才能將損失的風險降至最低。
