Blackwell Ultra

Blackwell Ultra是英偉達於2025年推出的新一代AI晶片,基於Blackwell架構設計,採用台積電4NP製程工藝與CoWoS-L封裝技術,集成雙Blackwell GPU及Grace CPU。該晶片配備288GB HBM3e記憶體,支持NVLink 5.0互聯協定,FP4精度算力達15PetaFLOPS,在AI推理場景中較前代Hopper架構實現最高40倍能效提升。其硬體創新包括液冷散熱系統與12層堆疊HBM3e記憶體技術,配套DGX SuperPOD等解決方案覆蓋自動駕駛、大模型訓練等套用領域。

基本介紹

  • 製程工藝:台積電4NP工藝
  • 記憶體容量:288GB HBM3e
  • 互聯技術:NVLink 5.0協定
  • 推出時間:2025年下半年
  • 電晶體數:2080億個
  • 能效提升:較Hopper提升25倍
技術架構,性能突破,產品生態,套用場景,技術演進,

技術架構

Blackwell Ultra採用雙Blackwell GPU與Grace CPU的異構設計,通過NVLink-C2C技術實現晶片間800Gbps通信頻寬。其B200 GPU核心集成2080億電晶體,使用台積電4NP工藝製造,單晶片面積約1600平方毫米。記憶體子系統搭載12層堆疊HBM3e技術,總容量達288GB,頻寬維持在8TB/s,通過NVLink 5.0協定支持16個GPU直連。封裝層面採用CoWoS-L技術替代傳統CoWoS-S方案,最佳化基板良率與信號完整性。

性能突破

在AI推理場景中,Blackwell Ultra的FP4浮點運算密度較前代B200提升50%,結合TensorRT-LLM框架實現每秒21088 token的吞吐量。對比Hopper H100 GPU:
  • 訓練性能提升4倍
  • 推理延遲降低90%
  • 電力消耗減少75%液冷技術的引入使散熱成本降低35%,在合成數據訓練等場景中效率提升40倍。硬體層面取消AsteraLabs重定時器設計,配合Dynamo引擎棧最佳化資源調度效率。

產品生態

英偉達圍繞Blackwell Ultra構建多層級解決方案:
  • DGX SuperPOD:單個機櫃集成72顆GPU,配備38TB記憶體與800Gb/s網路,推理性能較Hopper提升70倍
  • HGX平台:支持NVL72機架級部署,複雜任務處理耗時縮短90%,Llama 3.1 405B模型推理速度提升11倍
  • OGX Spark迷你主機:面向千億次運算需求,搭載Blackwell Ultra晶片組實現3000美元級解決方案同步推出的Instant AI Factory託管服務通過Equinix數據中心提供算力租賃,支持開箱即用的AI工厂部署。

套用場景

該晶片主要服務於三類場景:
  1. 大語言模型推理:在DeepSeek-R1等模型中實現25倍吞吐量提升,支持萬億參數模型實時推理
  2. 自動駕駛:合成數據訓練效率提升40倍,支持高精度感測器融合計算
  3. AI智慧型體開發:通過NVL72平台構建百萬級GPU集群,滿足物理AI的分散式訓練需求2025年GTC大會披露,美國四大雲服務商已採購360萬塊Blackwell架構晶片,主要用於AI訓練基礎設施升級。

技術演進

Blackwell Ultra屬於英偉達"四年三代"戰略的首代產品:
  • 2025年:Blackwell Ultra量產,採用HBM3e記憶體
  • 2026年:計畫推出Rubin平台並導入HBM4記憶體
  • 2027年:預計發布Rubin Ultra架構該路線圖旨在應對AI計算需求的超線性增長,黃仁勛在GTC 2025指出當前推理計算量較一年前預期高出100倍。

熱門詞條

聯絡我們