NVIDIA Vera Rubin 提升每瓦性能,為全球合作伙伴實現(xiàn)最低 Token 成本
在全球 300 多家合作伙伴的支持下Vera Rubin 正加速在全球范圍內擴大部署。CoreWeave、Google Cloud、Microsoft Azure 和 Mistral 等 NVIDIA 合作伙伴正紛紛部署 Vera Rubin該平臺在每瓦性能和最低 Token 成本方面樹立了基準測試的新標桿。NVIDIA Vera Rubin 正式登場正邁向十億瓦級規(guī)模部署。Vera Rubin NVL72 的量產正全面加速CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的機架已投入運行。Vera Rubin 的供應鏈覆蓋 30 個國家的 350 多家工廠擁有迄今為止規(guī)模最大、最成熟的機架級供應鏈旨在全面滿足客戶的算力需求。Vera Rubin 平臺從芯片到電網進行了全棧協(xié)同設計旨在提供最高的每瓦性能和最低的 Token 成本。CoreWeave 針對 DeepSeek-R1 的首次基準測試結果充分證明了這一點其每兆瓦吞吐量比 Grace Blackwell NVL72 提升了 10 倍——這直接切中了電力受限的 AI 工廠最關心的核心指標。通過極致協(xié)同設計提升性能取得這一突破的關鍵在于七款芯片和五種機架托盤之間的極致協(xié)同設計。五種機架系統(tǒng)包括 Vera Rubin NVL72、Vera CPU 機架、Groq 3 LPX、Spectrum-6 SPX 和 Vera BlueField-4 STX。它們被作為一個完整的系統(tǒng)進行工程研發(fā)而非由通用產品簡單拼湊而成。NVIDIA Vera CPU 正是其核心所在。它重新定義了“AI 工廠 CPU”應有的形態(tài)。專為智能體時代設計其定制 Olympus 核心相較競品的芯粒chiplet方案單線程性能提升 2 倍、核間帶寬提升 3 倍、內存延遲降低 40%使其成為面向最關鍵智能體負載時最高效的單線程 CPU。以專屬定制網絡加速 AI 工廠建設在網絡方面該平臺的第六代 NVLink 縱向擴展技術在處理復雜工作負載時相比通用以太網吞吐量提升超過 2 倍、延遲降低 1/3、數(shù)據包處理速率提升 10 倍。在橫向擴展方面Spectrum-X 以太網集成 102.4T 的 Spectrum-6 交換機系統(tǒng)、1.6T 的 ConnectX-9 SuperNIC、自適應路由、高級擁塞控制、遙測技術以及開放的操作系統(tǒng)支持使其 RDMA 帶寬比通用以太網高出 1.6 倍。包括 CoreWeave、微軟、SpaceXAI 和 Tesla 在內的全球領先的 AI 基礎設施建設者率先采用 Spectrum-6 交換機以加速其 AI 工廠的建設。此外采用 NVIDIA 光電一體化封裝CPO技術用于橫向擴展這是全球首款實現(xiàn)量產的同類型交換機與傳統(tǒng)可插拔收發(fā)器相比其能效提升了 5 倍平均無故障間隔時間MTBI提升了 10 倍。CoreWeave、Lambda 和 OCI 率先采用該技術。Spectrum-XGS 以太網跨站點吞吐量提升 1.9 倍實現(xiàn)跨站點性能增強。滿足十億瓦級 AI 工廠的建設不再局限于單一建筑的需求。同時NVLink Fusion 向第三方 XPU 開放了 NVIDIA 基礎設施平臺為合作伙伴能夠借助成熟的 NVLink 縱向擴展堆棧和生態(tài)系統(tǒng)實現(xiàn)產品的快速上市。節(jié)省部署時間節(jié)約水資源經過三代機架級協(xié)同設計的迭代NVIDIA 打造出的 Vera Rubin NVL72 系統(tǒng)實現(xiàn)了托盤內無電纜、無風扇、無液冷軟管的極簡設計將計算托盤的組裝時間從過去的數(shù)小時大幅縮短至僅需 1 分鐘。45 攝氏度的液冷進水溫度設計使得系統(tǒng)無需冷水機組僅靠干式冷卻器即可運行。對于新建的 AI 工廠而言這種高溫干式冷卻結合閉環(huán)液冷系統(tǒng)每兆瓦每年可節(jié)省數(shù)百萬加侖的水資源。NVIDIA Vera Rubin驅動歐洲開放模型時代Vera Rubin 正為歐洲的 AI 基礎設施注入下一代性能。Vera Rubin 也是微軟與 Mistral 新一輪深化合作的基石。該合作將前沿 AI 帶到了歐洲把開放的歐洲模型與云環(huán)境及客戶管理的環(huán)境相結合使各國政府和重點監(jiān)管行業(yè)能夠按照自身需求采用 AI 技術。Mistral 正在擴充其 GPU 算力通過引入數(shù)千個最新的 NVIDIA Vera Rubin GPU增加面向客戶的 AI 算力供給并為訓練、推理和大規(guī)模部署提供共享平臺。NVIDIA Vera Rubin 正邁入全面量產階段。這款機架級 AI 超級計算機將七款協(xié)同設計的全新芯片整合為一個統(tǒng)一系統(tǒng)它將調用數(shù)萬個 GPU為新一代 Mistral Compute 和微軟歐洲的 AI 基礎設施提供動力。打造真正適配當?shù)卣Z言、文化與法規(guī)的 AI 不應要求組織在創(chuàng)新、經濟效益與控制權之間做出取舍。以 Vera Rubin 為計算基礎依托微軟和 Mistral 提供的自主云基礎設施與歐洲開放模型歐洲完全可以三者兼得。CoreWeave 基準測試顯示NVIDIA Vera Rubin 系統(tǒng)每兆瓦Token 吞吐量達 Blackwell 的 10 倍通過與 NVIDIA 進行極致的協(xié)同設計CoreWeave 正依托 Vera Rubin NVL72 實現(xiàn)數(shù)量級的性能躍升。與 CoreWeave 等合作伙伴的緊密協(xié)作對于將新一代 NVIDIA 加速計算成功部署至 AI 工廠至關重要。經過數(shù)月的聯(lián)合工程研發(fā)CoreWeave 成為首家完成 Vera Rubin NVL72 部署與驗證的 AI 云服務提供商——他們首次公布了基于實際運行硬件測得的性能數(shù)據。CoreWeave 在 Vera Rubin NVL72 上運行了 DeepSeek-R1 基準測試。結果顯示與 Grace Blackwell NVL72 相比Vera Rubin NVL72 每兆瓦每秒 Token 吞吐量提升了 10 倍。每兆瓦 Token 吞吐量是決定 AI 基礎設施能否實現(xiàn)大規(guī)模盈利的核心指標。每兆瓦產出的 Token 越多意味著在同等電力預算下能產出更多的智能算力或者在顯著降低功耗的情況下處理相同的工作負載。Jane Street 等 AI 實驗室和企業(yè)將采用 Vera Rubin 平臺在 CoreWeave 云上擴展其 AI 工廠。NVIDIA Vera Rubin 系統(tǒng)驅動全新 Google Cloud A5X 實例助力 Ineffable Intelligence 發(fā)展NVIDIA Vera Rubin NVL72 正在為 Google Cloud 的首個 A5X 實例提供算力支持該實例現(xiàn)已由倫敦初創(chuàng)公司 Ineffable Intelligence 率先采用。Ineffable Intelligence 致力于開發(fā)新一代智能“Superlearner”系統(tǒng)該系統(tǒng)能夠通過經驗持續(xù)學習從而在各個領域實現(xiàn)新的突破。NVIDIA Vera Rubin NVL72 專為這類智能體訓練而設計能夠提供可預測的低延遲、高利用率以及遠超上一代系統(tǒng)的單位智能算力產出。這使其成為大規(guī)模強化學習的理想平臺選擇。在 Google Cloud Next 上發(fā)布的 Google Cloud A5X 實例是基于 NVIDIA Vera Rubin NVL72 機架級系統(tǒng)構建的裸金屬實例。與上一代相比其每 Token 推理成本降低至 1/10每兆瓦 Token 吞吐量提升了 10 倍。NVIDIA Vera CPU助力 DeepInfra AI 云實現(xiàn)編排速度翻倍DeepInfra 的基準測試結果顯示NVIDIA Vera CPU 的運行速度是其他 CPU 的 2 倍以上并且能夠支持更多并發(fā)的 AI 智能體。作為 NVIDIA 開放 AI 生態(tài)系統(tǒng)的早期伙伴云平臺 DeepInfra 基于其生產級 AI 智能體基礎設施獨立設計并運行了基準測試。DeepInfra 每周處理近 5 萬億個 Token其中約 30% 由智能體系統(tǒng)驅動。其云平臺專為高吞吐量的 AI 推理而打造?;鶞蕼y試表明在保持相同服務質量的前提下Vera CPU 支持的并發(fā) AI 智能體數(shù)量比其他 CPU多出高達 1.6 倍編排速度快 2.2 倍同時還能提高基礎設施的利用率和成本效益。這些結果充分證明NVIDIA Vera CPU 能夠提供生產級智能體 AI 所需的成本效益、低延遲和高吞吐量。DeepInfra 的基準測試充分凸顯了 NVIDIA Vera CPU 如何幫助云服務提供商提升基礎設施利用率、提高成本效益并在保持相同服務質量的前提下支持更多并發(fā)的 AI 智能體。

相關新聞

Grove三軸加速度計MMA7660FC實戰(zhàn):從I2C通信到姿態(tài)解算

Grove三軸加速度計MMA7660FC實戰(zhàn):從I2C通信到姿態(tài)解算

1. 項目概述:從“Grove - 三軸數(shù)字加速度計(1.5g)”說起如果你玩過Arduino或者樹莓派,大概率聽說過Grove這個生態(tài)系統(tǒng)。它最大的魅力,就是把一堆復雜的傳感器、執(zhí)行器,變成了像樂高積木一樣可以“咔噠”一聲插上就用的模塊&#x…

2026/8/2 19:27:02 閱讀更多
OpenGL 3D圖形開發(fā):從MVP矩陣到第一人稱攝像機實現(xiàn)

OpenGL 3D圖形開發(fā):從MVP矩陣到第一人稱攝像機實現(xiàn)

1. 項目概述與核心價值如果你已經跟著上一章的內容,成功搭建好了C和OpenGL的開發(fā)環(huán)境,并且讓第一個三角形在屏幕上亮了起來,那么恭喜你,你已經跨過了從零到一最艱難的那道坎。這一章,我們要做的不是繼續(xù)畫更復雜的圖形…

2026/8/2 19:27:02 閱讀更多
3分鐘搞定!QQ空間歷史說說完整備份終極指南

3分鐘搞定!QQ空間歷史說說完整備份終極指南

3分鐘搞定!QQ空間歷史說說完整備份終極指南 【免費下載鏈接】GetQzonehistory 獲取QQ空間發(fā)布的歷史說說 項目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 你是否曾想過,那些年發(fā)過的QQ空間說說,那些記錄青春的文字…

2026/8/2 0:04:01 閱讀更多
3分鐘搞定!QQ空間歷史說說完整備份終極指南

3分鐘搞定!QQ空間歷史說說完整備份終極指南

3分鐘搞定!QQ空間歷史說說完整備份終極指南 【免費下載鏈接】GetQzonehistory 獲取QQ空間發(fā)布的歷史說說 項目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 你是否曾想過,那些年發(fā)過的QQ空間說說,那些記錄青春的文字…

2026/8/2 0:04:01 閱讀更多
AMAT 0100-02186 I/O 分配 PCB

AMAT 0100-02186 I/O 分配 PCB

AMAT 0100-02186 I/O分配PCB板是應用材料(Applied Materials)公司生產的一款用于半導體設備的I/O信號分配電路板。該型號(0100-02186)的核心特點如下:專用于Endura等半導體工藝腔室。集成信號路由與分配功能。連接控制…

2026/8/2 2:51:21 閱讀更多
Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動機

Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動機

Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動機是日本日清(Nissei)品牌的一款工業(yè)用三相異步電機,適用于自動化設備及通用機械驅動。該型號(FFMN-32L-10-T0 40AX)的核心特點如下:三相交流異步電動機。額定…

2026/8/2 2:52:49 閱讀更多