Rubin GPU

Rubin GPU

Rubin GPU是英偉達(NVIDIA)推出的新一代人工智慧晶片,於2026年1月的CES 2026上正式發布,計畫於2026年第三或第四季度進入量產階段。該晶片於2025年6月完成設計階段關鍵工作並完成流片,同年9月向客戶提供樣品,後因應對AMD MI450加速器競爭將功耗從1800W調整至2000W並重新流片。在GTC 2026大會上,英偉達將進一步詳細介紹其部署時間表與性能指標。

Rubin GPU採用台積電第三代3納米製程工藝(N3P)及CoWoS-L封裝技術,擁有3360億個電晶體,計算晶片使用N3P製程並通過SoIC三維垂直堆疊技術集成兩顆計算晶片與一顆N5B製程I/O晶片,首次支持8層HBM4高頻寬記憶體,單卡容量達到288GB,頻寬高達22 TB/s。Rubin GPU的NVFP4推理算力為50 PFLOPS,是前代Blackwell的5倍,單晶片可運行千億參數AI模型,訓練大模型所需的GPU系統數量減少至四分之一,整體吞吐量提升10倍。其互聯總頻寬達到了260 TB/s。配套Vera CPU配備88個定製Arm架構核心,通過第六代NVLink技術實現互聯。主機板設計集成一顆Vera CPU與兩顆大型Rubin GPU。NVL144機櫃支持144顆GPU,可提供3.6 exaflops FP4算力。衍生型號Rubin CPX GPU專為長上下文推理設計,結合144顆Rubin GPU、144顆CPX GPU及36顆Vera CPU組成的NVL144 CPX機櫃可提供8 exaflops FP4算力。英偉達計畫在2027年下半年推出Rubin Ultra NVL576平台,該系統將搭載四顆Reticle尺寸核心,配備1 TB HBM4e顯存並提供15 exaflops FP4推理算力,並引入微通道冷板散熱技術以應對更高功耗需求。

基本介紹

  • 外文名:Rubin GPU
  • 所屬品牌:NVIDIA
產品歷程,性能提升,規格參數,主要功能,

產品歷程

2026年1月6日,英偉達在CES 2026上正式發布了基於Vera Rubin架構的Rubin GPU。隨後在2026年3月16日至19日的GTC 2026大會上,英偉達進一步詳細介紹了其部署時間表、性能指標以及相較於Blackwell架構在擴展性方面的提升。
2026年1月13日,韓國科技信息通信部第二次官Ryu Je-myung在CES 2026期間訪問英偉達美國總部後表示,英偉達承諾將優先向韓國供應計畫於2027年量產的Vera Rubin系列GPU,並提前供應Blackwell GB300 GPU,旨在幫助韓國在人工智慧模型的競爭中領先使用最新GPU。此前,2025年10月,英偉達已宣布計畫與韓國政府和主要企業合作,向韓國供應多達26萬個GPU以建立人工智慧工廠。
2026年1月6日,英偉達在CES 2026上正式發布了Vera Rubin架構,由CEO黃仁勛在NVIDIA Live活動上發布,此次發布會是英偉達5年來首次未在CES上發布消費級顯示卡,重點轉向物理AI和機器人技術。其中包括核心組件Rubin GPU,該GPU引入了HBM4顯存,單卡容量達到288GB,頻寬高達22 TB/s。同時發布的還包括Vera CPU、ConnectX-9網卡、BlueField-4 DPU、NVLink-6交換晶片和Spectrum-6光乙太網交換晶片等六款新晶片,共同構成Vera Rubin AI平台。
2025年6月9日訊息,Rubin GPU已完成設計階段的關鍵工作,預計將於6月完成流片,最快於9月向客戶提供樣品。

性能提升

根據2026年CES發布的信息,採用Vera Rubin架構的Rubin GPU在AI訓練和推理中帶來顯著性能提升,推理Token成本降低至十分之一,算力性能提升至五倍。具體而言,Rubin GPU在NVFP4推理能力上達到50 PFLOPS,是前代Blackwell的5倍。具體而言,在NVFP4訓練方面,性能達到2.5 EFLOPS,實現3.5倍的性能提升。對於單個Rubin GPU,訓練能力達到35 PFLOPS,是前代的3.5倍。訓練大模型(如10萬億參數模型)所需的GPU系統數量減少至四分之一。此外,整體吞吐量(每瓦-每美元可完成的AI Token數)提升10倍。這些性能提升是在整體規模相比Blackwell僅提升1.6倍的背景下實現的,能耗比也有顯著提升。

規格參數

採用台積電第三代3納米製程工藝(N3P),並搭載先進的CoWoS-L封裝技術。
Rubin GPU擁有3360億個電晶體,比前代Blackwell增加了1.6倍,搭載第三代Transformer引擎,NVFP4推理算力為50 PFLOPS,是Blackwell的5倍。
該GPU首次支持8層HBM4高頻寬記憶體。

主要功能

Rubin GPU引入了HBM4顯存,配備8堆疊HBM4高頻寬記憶體。
單卡HBM4顯存容量達到288GB,頻寬高達22 TB/s。此外,通過第六代NVLink技術,其互聯總頻寬達到了260 TB/s。採用Vera Rubin架構的Rubin GPU,使得AI推理Token成本直接暴降10倍,算力性能狂飆5倍。

相關詞條

熱門詞條

聯絡我們