在2026年國際消費電子展(CES)上,NVIDIA執行長黃仁勳正式揭曉了下一代人工智慧計算架構“維拉·魯賓”(Vera Rubin)。該架構預計將成為未來遊戲顯示卡的基礎,並已進入全面投產階段,計劃於今年下半年開始向客戶交付。

遊俠網1

  作為當前Blackwell架構的繼任者,維拉·魯賓在效能上實現顯著突破。據NVIDIA介紹,其在推理任務中效能提升高達5倍,大型語言模型訓練效率提高3.5倍,同等任務所需GPU數量可減少至原先的四分之一。

遊俠網2

遊俠網3

  該架構主要由六大核心元件構成:

  基於Armv9.2的88核Vera中央處理單元

  採用NVFP4格式、算力達50 petaflops的Rubin圖形處理單元

  頻寬達3.6 TB/s的第六代NVLink交換機

  ConnectX-9 SuperNIC網路介面卡與BlueField-4資料處理單元

  Spectrum 6乙太網交換機

遊俠網4

  新架構在能效與可靠性方面尤為突出。透過整合Spectrum-X乙太網光子技術與光學連線,功耗降低至原先的五分之一,連線可靠性則提升十倍。黃仁勳指出,這一飛躍得益於製造工藝的進步,儘管電晶體數量僅增加1.6倍,但整體效能大幅躍升。首批合作客戶將包括雲服務商CoreWeave與Microsoft Azure。

  此次釋出正值AI加速器市場競爭加劇之際。面對AMD等傳統對手以及谷歌等客戶自研晶片的挑戰,NVIDIA試圖透過維拉·魯賓架構實現效能與成本的雙重突破——預計將使AI推理的每token成本下降至原來的十分之一。