18+

NVIDIA擴展代理型AI佈局 Groq 3 LPX全面量產與Vera基礎設施全解析

NVIDIA 於今年Hot Chips 2026大會上,將焦點從單一晶片運算能力,全面轉向針對「代理型AI」 (Agentic AI)打造的系統級基礎設施。從整合Groq技術的推論加速器、SpaceXAI對Vera CPU的採用,到徹底翻新架構的乙太網路技術,NVIDIA試圖透過極致的軟硬體協同設計 (Co-design),為下一代AI工廠樹立全新的能效與延遲標準。

互動式推論新利器:Groq 3 LPX全面量產

代理型AI需要在極短時間內進行連續生成、工具調用與邏輯驗證,使得「解碼延遲」 (Decode Latency)成為運算瓶頸。NVIDIA此次宣布互動式AI推論加速器Groq 3 LPX正式進入全面量產,並且作為Vera Rubin平台的關鍵延伸。

效能破紀錄:根據Artificial Analysis的基準測試,Groq 3 LPX在執行開源模型Gemma 4 31B (100K詞元 (Tokens)長情境)時,達到驚人的每秒3400詞元輸出。

異質分工架構:系統將大型上下文 (Context)處理交由Vera Rubin NVL72負責,而對延遲極度敏感的詞元生成 (Token Generation)則交由Groq 3 LPX處理,整體反應速度較競品快上4倍。

SpaceXAI導入Vera CPU,將AI算力推向軌道

針對AI代理複雜的任務編排與資料處理,NVIDIA推出首款專為代理型AI打造的處理器——Vera CPU。

大規模佈署:SpaceXAI宣布將全面佈署Vera CPU來驅動其新一代AI應用,專門處理推論過程中的程式碼執行與資料編排。

跨足太空運算:SpaceXAI計畫將經過最佳化的Vera Rubin NVL72機櫃級系統,直接應用於其第一代「Starmind AI」衛星,在嚴苛的功耗限制下實現軌道級算力。

極致能效比:NVIDIA官方首度公布晶片級效能數據,在SemiAnalysis AgentX工作負載下,Vera Rubin NVL72的每瓦效能 (Work per Watt)提升高達30倍。

Spectrum-X Multiplane與Scale-In基礎設施

隨著AI工廠規模逼近GW (吉瓦)級別,傳統網路架構的延遲與建置成本,早已無法承受龐大的資料吞吐。

打破擴展瓶頸:最新的Spectrum-X Multiplane乙太網路架構,能讓硬體加速網路在不增加第三層交換器層級的狀況下,將叢集規模極限擴展至512000組GPU,大幅消除網路抖動與無謂的建置成本。

統一加速領域:透過BlueField-4處理器與DOCA軟體平台驅動,最新的Scale-In基礎設施能將傳統的南北向存取網路,無縫轉變為具備高度安全與韌性的加速網路。

從「算力堆疊」走向「精準分工」的必然趨勢

NVIDIA在Hot Chips 2026展現的戰略思維非常清晰:面對代理型AI的崛起,單純依賴GPU的暴力運算已經變得不切實際。透過Vera CPU處理邏輯編排、Rubin GPU吞吐龐大上下文,再交由Groq 3 LPX負責極速解碼,最後以Spectrum-X網路串接整個機房;NVIDIA已經不僅僅是一家晶片供應商,而是牢牢掌握從邊緣到太空、從運算到通訊的完整AI系統架構主導權。這種將多元運算單元極致融合的「全端封閉生態」,將為未來的競爭對手築起一道極難跨越的硬體護城河。

《原文刊登於合作媒體mashdigi,聯合新聞網獲授權轉載。》

本日熱門 本周最熱 本月最熱