IT之家 7 月 22 日消息,英偉達(NVIDIA)昨日(7 月 21 日)發布博文,宣佈其 Vera Rubin 正邁步萬億級規模部署。
英偉達在博文中指出,公司正加速量產 Vera Rubin NVL72,並已在 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴內部運行。
英偉達表示為了滿足全球客戶的計算需求,Vera Rubin 在 30 個國家擁有 350 多個工廠,建立了有史以來規模最大、最成熟的機架級供應鏈。
CoreWeave 公司昨日(7 月 21 日)發布博文,表示該公司於 6 月初完成了業界首個 NVIDIA Vera Rubin NVL72 的上電和驗證工作,搭建了端到端的機架級系統,包括電源、冷卻、網絡和計算均已驗證並運行。
IT之家翻譯博文相關內容如下:
DeepSeek R1 是驅動當前智能體 AI(Agentic AI)激增的推理模型之一,因此在部署 Vera Rubin NVL72 和 NVIDIA Blackwell NVL72 後,我們基於該模型做了相關測試。
在本次測試評估中,我們着重評估每兆瓦吞吐量(token throughput per megawatt)以及交互性(TPS / user,表明用戶或智能體在模型處理任務時所體驗到的響應速度)之間的關係。
在匹配的交互性目標下,在相同 DeepSeek R1 工作負載下,相比較 NVIDIA GB200 NVL72,Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍。
