【即時新聞】輝達(NVDA)宣布Groq 3伺服器量產!低延遲AI推論迎爆發

權知道

權知道

  • 2026-08-25 00:48
  • 更新:2026-08-25 00:48
【即時新聞】輝達(NVDA)宣布Groq 3伺服器量產!低延遲AI推論迎爆發

砸下200億美元收購案發酵!全新伺服器機架即將上線

輝達(NVDA)最新宣布,旗下Groq 3 LPX伺服器機架已全面進入量產階段,這標誌著該公司史上最大規模收購案的技術正式走向商業化。輝達高層Dion Harris向媒體透露,這款全新機架將與Vera中央處理器以及Rubin圖形處理器,共同部署於新興雲端服務商Nebius的資料中心,並預計於今年稍晚正式上線提供服務。

鎖定低延遲推論需求,雲端服務商可藉此推出頂級方案

積極投入Groq晶片製造並提供給客戶,凸顯了低延遲推論技術在當前市場的重要性日益增加。這項技術能讓AI代理具備更即時的反應速度,為使用者消除漫長的等待時間,尤其在程式碼編寫領域更為關鍵。輝達指出,對於提供詞元(Token)運算的雲端業者而言,這項技術解鎖了頂級服務方案的能力,能精準滿足對延遲極度敏感的客戶需求。

三星代工與台積電分工,每秒處理高達3400個詞元

輝達在去年12月斥資200億美元收購新創晶片公司Groq的資產,成為其最大手筆的併購案。在技術規格上,Groq架構在晶片內部直接整合高達500MB的高速靜態隨機存取記憶體(SRAM),藉此大幅減少記憶體傳輸瓶頸。值得注意的是,Groq晶片是由三星代工製造,而輝達的常規圖形處理器則由台積電生產。每個LPX機架內含256顆Groq 3晶片,根據基準測試機構Artificial Analysis的數據,該系統每秒可產出高達3400個詞元。

AI晶片競爭白熱化!超微與OpenAI緊追在後

低延遲AI晶片市場競爭相當激烈,超微(AMD)在今年稍早宣布,將把近期剛上市的Cerebras晶片整合至其機架級系統中,同樣主攻低延遲推論領域。另一方面,OpenAI最新公布的Ultrafast模式目前標榜每秒可達750個詞元,背後正是由Cerebras提供技術支援。面對競爭,輝達強調低延遲晶片主要專注於模型服務中的「解碼」階段,並非要取代能同時處理訓練與推論的通用型圖形處理器。

執行長黃仁勳目標明確,瞄準高達一兆美元的累計銷售額

「這不是為了取代圖形處理器,而是要在適當的價格與工作負載區塊中,使用最合適的處理器。」目前輝達正加速出貨今年初開始生產的Vera Rubin系統。執行長黃仁勳在3月的發表會上曾預估,到2027年,當前世代的Blackwell晶片與全新的Vera Rubin系統將創造高達1兆美元的累計銷售額。他當時表示,預計將資料中心四分之一的空間分配給負責程式碼應用的Groq晶片,其餘空間則全面部署Vera Rubin系統,市場也正密切關注即將發布的財報表現。

關於輝達的業務拓展與最新市場表現

輝達(NVDA)是全球頂尖的圖形處理器(GPU)設計商,早期產品主要用於強化遊戲PC的運算體驗。近年來,GPU已成為推動人工智慧運作大型語言模型的重要半導體核心。除了硬體設備,輝達還提供Cuda軟體平台供AI模型開發與訓練使用,並積極擴展資料中心網路解決方案。在最新交易日中,輝達收盤價為214.72美元,下跌2.13美元,跌幅為0.98%,單日成交量達98,869,300股,成交量較前一日變動6.94%。

【即時新聞】輝達(NVDA)宣布Groq 3伺服器量產!低延遲AI推論迎爆發
文章相關股票
權知道

權知道

我們重視「知」的權利 不惜抽絲剝繭、深入調查 只為讓投資人不錯過重要的投資訊息