Rubin(英偉達公司開發的AI晶片架構)

Rubin(英偉達公司開發的AI晶片架構)

本詞條是多義詞,共2個義項
更多義項 ▼ 收起列表 ▲

Rubin是英偉達公司開發的下一代AI晶片架構,作為Blackwell架構的繼任者,於2024年6月台北國際電腦展首次公布。該架構於2025年3月GTC大會正式發布技術細節,其命名源自美國天文學家薇拉·魯賓,以紀念她對暗物質研究的貢獻,延續了英偉達連續四代以女性科學家命名的傳統。根據2025年12月美國政府政策,Rubin架構被明確排除在對華出口許可範圍。在2026年1月的CES展會上,英偉達執行長黃仁勛宣布Rubin架構已提前全面投產,全部六款Rubin晶片已完成製造和關鍵測試,正按計畫推進,並將於2026年下半年開始向微軟等首批客戶交付。基於Rubin架構的系統運行成本將低於基於Blackwell架構的系統,因其使用更少的組件即可實現相同結果。Rubin架構由六顆全新晶片組成,被設計為協同工作的整體,包括定製的Vera CPU、Rubin GPU、先進的乙太網交換機等。新硬體還包括網路和連線組件,將成為DGX SuperPod超級計算機的一部分,也可作為單獨產品供客戶模組化使用。

首款產品R100採用台積電3nm EUV工藝製造,通過獨立I/O晶片設計增加流式多處理器數量,支持8層HBM4高頻寬記憶體,升級版Rubin Ultra支持12層HBM4。該架構與Vera CPU組成超級晶片系統,搭載NVLink 6 Switch實現3600 GB/s連線速度,整卡熱設計功耗達2300瓦。Rubin系列包含專為超長上下文AI任務設計的Rubin CPX GPU,採用解耦推理架構和128GBGDDR7記憶體。配套的Vera Rubin NVL144 CPX平台整合144個Rubin CPX GPU、144個Rubin GPU和36個Vera CPU,單機架AI算力達8 exaflops。其升級版Rubin Ultra計畫引入微通道冷板散熱技術,並採用光纜互聯CPO技術及高壓直流供電方案。相比上一代Blackwell架構,Rubin在模型訓練任務中的運行速度提升3.5倍,推理任務中提升5倍,峰值性能可達50 PFLOPS。Rubin Ultra NVL576平台計畫於2027年下半年推出,支持1 TB HBM4e顯存,在FP4精度下推理性能達15 ExaFLOPS。英偉達財務長科萊特·克雷斯在2025年11月財報會議中預測,從2025年初至2026年底,Blackwell和Rubin架構的總收入將達到5000億美元。根據2025年11月財報披露,英偉達未交付的晶片訂單總額已達約5000億美元,訂單已排期至2026年。Rubin平台的推出直接推動了存儲晶片供應鏈的結構性調整,KB證券預計三星的HBM晶片出貨量將同比增長2.5倍。其客戶包括亞馬遜、谷歌、微軟、甲骨文等大型雲計算提供商。

在散熱技術層面,Rubin架構的VR200 NVL72平台採用微通道冷板(MCCP)搭配鍍金散熱蓋技術,並更深入地依賴液冷方案,其機櫃冷卻液流量需求相對於前代產品幾乎增加100%。

基本介紹

  • 所屬公司:英偉達
  • 產品類型:GPU架構
  • 發布時間:2026年(計畫)  
  • 命名由來:天文學家薇拉·魯賓  
  • 記憶體類型:HBM4  
  • 互聯技術:第六代NVLink 
消費級顯示卡套用,發布與部署,技術規格,行業影響,開發背景,命名由來,產品疊代,

消費級顯示卡套用

根據2026年1月的行業訊息,英偉達計畫於2027年下半年推出基於Rubin架構的GeForce RTX 60系列消費級顯示卡,其核心GPU家族代號為GR20x。競爭對手AMD的下一代RDNA 5架構遊戲顯示卡將選擇在RTX 60系列發布之後上市,以避免與英偉達的首發產品直接競爭。

發布與部署

在2026年1月的CES展會上,英偉達執行長黃仁勛宣布Rubin架構已提前全面投產,全部六款Rubin晶片已完成製造和關鍵測試,正按計畫推進,並將於2026年下半年開始向微軟等首批客戶交付。黃仁勛在CES演講中透露,Rubin已全面投產,將於2026年下半年正式面世。Rubin架構由六顆全新晶片組成,被設計為協同工作的整體,包括定製的Vera CPU、Rubin GPU、先進的乙太網交換機等。首批產品計畫於2026年下半年交付給客戶,亞馬遜、谷歌、微軟、甲骨文等雲服務商將成為首批部署的客戶。此外,OpenAI等多家巨頭也已宣布將部署該平台。基於Rubin架構的系統運行成本將低於基於Blackwell架構的系統,因其使用更少的組件即可實現相同結果。具體而言,可將AI推理token成本降至前代Blackwell平台的十分之一,MoE模型訓練GPU用量減少75%。相比上一代Blackwell架構,Rubin在模型訓練任務中的運行速度提升3.5倍,推理任務中提升5倍,峰值性能可達50 PFLOPS(每秒浮點計算次數)。新硬體還包括網路和連線組件,將成為DGX SuperPod超級計算機的一部分,也可作為單獨產品供客戶模組化使用。

技術規格

採用HBM4高頻寬記憶體,其首款產品R100支持8層HBM4,升級版Rubin Ultra支持12層HBM4。Rubin架構於2026年1月在CES 2026上宣布已全面投產,並計畫於2026年下半年開始向客戶交付。該架構搭載NVLink 6 Switch互連技術,實現3600 GB/s連線速度,並與Vera CPU組成超級晶片系統。Rubin架構由六顆全新晶片組成,被設計為協同工作的整體,包括定製的Vera CPU、Rubin GPU、先進的乙太網交換機等。相比上一代Blackwell架構,Rubin在模型訓練任務中的運行速度提升3.5倍,推理任務中提升5倍,峰值性能可達50 PFLOPS。同時,Rubin平台可將AI推理token成本降至前代Blackwell平台的十分之一,MoE模型訓練GPU用量減少75%。在散熱設計方面,Rubin架構更深入地依賴液冷方案,其VR200 NVL72平台採用微通道冷板(MCCP)搭配鍍金散熱蓋技術,升級版Rubin Ultra計畫引入微通道冷板散熱技術。

行業影響

英偉達財務長科萊特·克雷斯在2025年11月財報會議中預測,從2025年初至2026年底,Blackwell和Rubin架構的總收入將達到5000億美元。根據2025年11月財報披露,英偉達未交付的晶片訂單總額已達約5000億美元,訂單已排期至2026年。作為Blackwell架構的繼承者,Rubin的推出將延續英偉達“每年更新架構”的技術策略。與此同時,其競爭對手AMD在CES 2026上發布了專為企業本地AI部署設計的MI440X GPU,並預告下一代MI500 GPU計畫於2027年發布,AI性能預計將比MI300X GPU提升高達1000倍。OpenAI總裁Greg Brockman在CES 2026上表示,儘管每年計算能力增加三倍,算力需求仍無法滿足,OpenAI與AMD達成合作以緩解算力不足問題。雙方將在數據中心GPU市場與英偉達展開直接競爭。
根據CES 2026上發布的信息,Rubin平台作為首個六晶片協同設計的AI超級計算平台,可將AI推理token成本降至前代Blackwell平台的十分之一,MoE模型訓練GPU用量減少75%,微軟、OpenAI等多家巨頭已宣布將部署該平台。Rubin平台的推出直接推動了存儲晶片供應鏈的結構性調整,KB證券預計三星的HBM晶片出貨量將同比增長2.5倍。
在散熱技術層面,Rubin架構的VR200 NVL72平台採用微通道冷板(MCCP)搭配鍍金散熱蓋技術,並更深入地依賴液冷方案,其機櫃冷卻液流量需求相對於前代產品幾乎增加100%。高功率情形下,液冷方案逐漸替代風冷成為數據中心主流散熱方案。微通道冷板技術有望成為下一代散熱主流趨勢,並可能推動供應鏈格局變化。
該架構與同期發布的CPU、互連技術協同,標誌著AI計算系統向更深層次的異構集成發展。
根據2025年12月美國政府政策,Rubin架構被明確排除在對華出口許可範圍,特朗普在聲明中強調“將保護美國在AI領域的領先地位”。

開發背景

根據英偉達2024年6月公布的路線圖,Rubin被定位為Blackwell架構的下一代產品。在2025年3月的GTC大會上,CEO黃仁勛正式披露了該架構的技術細節。
2026年1月6日,英偉達CEO黃仁勛在拉斯維加斯消費電子展(CES)上宣布,Rubin架構已提前全面投產,全部六款Rubin晶片已完成製造和關鍵測試,正按計畫推進,並將於2026年下半年開始向微軟等首批客戶交付。

命名由來

2025年3月,英偉達官方確認該架構以天文學家薇拉·魯賓命名。這位天文學家因發現星系旋轉曲線異常現象,為暗物質研究奠定基礎而聞名學界。

產品疊代

  • Rubin基礎版:預計2026年發布,集成HBM4記憶體和第六代NVLink
  • Rubin Ultra:計畫2026年推出,記憶體堆疊升級至12層

相關詞條

熱門詞條

聯絡我們