DeepSeek R1推理測試:英偉達Vera Rubin吞吐量提升10倍

IT之家
07/22

IT之家 7 月 22 日消息,英偉達(NVIDIA)昨日(7 月 21 日)發布博文,宣佈其 Vera Rubin 正邁步萬億級規模部署。

英偉達在博文中指出,公司正加速量產 Vera Rubin NVL72,並已在 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴內部運行。

英偉達表示為了滿足全球客戶的計算需求,Vera Rubin 在 30 個國家擁有 350 多個工廠,建立了有史以來規模最大、最成熟的機架級供應鏈。

CoreWeave 公司昨日(7 月 21 日)發布博文,表示該公司於 6 月初完成了業界首個 NVIDIA Vera Rubin NVL72 的上電和驗證工作,搭建了端到端的機架級系統,包括電源、冷卻、網絡和計算均已驗證並運行。

IT之家翻譯博文相關內容如下:

DeepSeek R1 是驅動當前智能體 AI(Agentic AI)激增的推理模型之一,因此在部署 Vera Rubin NVL72 和 NVIDIA Blackwell NVL72 後,我們基於該模型做了相關測試。

在本次測試評估中,我們着重評估每兆瓦吞吐量(token throughput per megawatt)以及交互性(TPS / user,表明用戶或智能體在模型處理任務時所體驗到的響應速度)之間的關係。

在匹配的交互性目標下,在相同 DeepSeek R1 工作負載下,相比較 NVIDIA GB200 NVL72,Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10