英偉達H100晶片(H100(英偉達推出的AI晶片))

英偉達H100晶片(英偉達公布的全新架構GPU晶片)

H100(英偉達推出的AI晶片)一般指本詞條

本詞條是多義詞,共2個義項
更多義項 ▼ 收起列表 ▲

英偉達H100晶片是英偉達公司於2022年3月22日在GTC技術大會發布的首款基於Hopper架構的GPU晶片,採用台積電四納米工藝製造,集成800億個電晶體,搭載HBM3顯存技術並支持PCIe 5.0接口及第四代NVLink互連技術,其功耗峰值為700瓦。該晶片於2022年第三季度正式上市,日本市場於同年5月率先上架銷售。2022年8月美國政府對A100和即將出貨的H100實施出口管制,2023年11月新增限制禁止向中國等地區出口。

H100晶片的Transformer引擎可將自然語言處理模型速度提升至前代六倍,在MLPerf基準測試中通過3,584塊GPU集群實現11分鐘完成GPT-3模型訓練,通過TensorRT-LLM技術使大語言模型推理性能較A100提升4.6倍。2025年12月,Meta公司與英偉達簽署價值50億美元的H100晶片訂單。同月,Mistral AI推出的Devstral 2 (123B)編程模型本地部署時要求至少需要4塊H100級GPU支持;另有AI開發者通過修復搭載雙NVIDIA GH200超級晶片(集成H100 GPU)的伺服器,成功在本地運行參數規模高達2350億的大語言模型。此外,部分研究團隊曾使用8×H100 GPU集群進行視頻生成相關的模型預訓練。在2026年初的IndySCC學生超算競賽中,浙江大學超算隊也使用了H100顯示卡節點。

2025年11月初,美國初創公司Starcloud通過SpaceX火箭將搭載強化版H100 GPU集群的Starcloud-1衛星送入軌道,該衛星體積為冰櫃大小(重約60公斤),採用軌道持續太陽能供電並實現高效散熱。衛星基於H100晶片的壽命預期為5年,而太空環境中的輻射對英偉達H100等商用級高性能計算硬體構成挑戰。2025年12月,該衛星成功完成人類首次太空大語言模型訓練,運行谷歌Gemma模型和NanoGPT,並測試處理Capella Space衛星影像數據,檢測海上翻覆船隻的救生筏及森林火災熱特徵,提供實時救援警報。Starcloud計畫於2026年10月發射搭載多塊H100晶片及英偉達新一代Blackwell平台的新衛星,並部署Crusoe Cloud服務。中國企業中科天算的極光5000星載智慧型機計畫於2026年進行在軌驗證,其搭載的國產全尺寸GPU性能也對標H100。

英偉達在2025年發布了性能更強的H200 GPU。到2026年初,英偉達已推出性能更強的B300 GPU,而H100的市場占比萎縮至不足10%。根據Epoch AI在2026年發布的報告,全球AI算力總容量已達到1500萬個H100 GPU當量。美國在同期宣布放寬對華高端GPU出口管制,允許英偉達向中國客戶交付H200等新型號,英偉達要求中國客戶預付全款採購其H200人工智慧晶片。

基本介紹

  • 中文名:英偉達H100晶片
  • 所屬品牌:NVIDIA 
  • 產品類型:GPU晶片 
  • 公布時間:2022年3月22日 
市場競爭,技術挑戰,發展歷程,相關事件,晶片套用,規格參數,

市場競爭

根據Epoch AI在2026年發布的報告,全球AI算力總容量已達到1500萬個H100 GPU當量。
截至2025年底,以摩爾執行緒、沐曦股份、壁仞科技等為代表的中國國產GPU企業迎來爆發期,其產品普遍將英偉達H100 GPU作為主要性能對標對象。
同時,國際巨頭如谷歌的TPU和亞馬遜的Trainium晶片也在市場份額中占據一定比例,試圖突破英偉達的統治。
隨著英偉達在2025年發布性能更強的H200 GPU,H100的市場領先地位面臨疊代壓力。美國在同期宣布放寬對華高端GPU出口管制,允許英偉達向中國客戶交付H200等新型號,此舉旨在與正在突破的國產GPU企業爭奪市場。
到2026年初,英偉達已推出性能更強的B300 GPU,並占據其AI晶片營收的大頭,而H100的市場占比萎縮至不足10%。
儘管面臨國際巨頭的激烈競爭和技術疊代壓力,中國GPU產業在外部壓力和內部市場需求的雙重驅動下,已形成一定規模,並在資本市場獲得認可。

技術挑戰

太空環境中的輻射硬化難題對英偉達H100等商用級高性能計算硬體構成挑戰,太空充滿高能宇宙射線和帶電粒子,足以對未加保護的積體電路造成位翻轉、門鎖甚至永久性損傷。採用特種抗輻射(Rad-Hard)晶片雖可解決可靠性問題,但其製程往往落後消費級晶片數代,性能與成本代價高昂。如何在商用級高性能計算硬體與必要的輻射防護之間找到平衡,是工程上的核心難題。
在地面部署中,H100晶片也面臨能源和電力基礎設施的嚴峻挑戰。根據行業報告,全球AI算力總容量已達到1500萬H100 GPU當量,晶片運作功耗高達10GW,相當於兩個紐約市的平均用電量,引發能源可持續性危機。此外,電力供應短缺導致GPU閒置問題突出,微軟CEO納德拉指出缺少“熱殼”(即基礎設施完備的已完工數據中心),造成晶片供應與電力建設的時間差錯配,可能使昂貴硬體面臨閒置和貶值風險。

發展歷程

2022年3月22日,英偉達在GTC技術大會上公布英偉達H100晶片。
2022年5月,日本一零售商掛出了NVIDIA最新的H100 Hopper加速計算卡。

相關事件

美國GPU晶片限令
當地時間2022年8月31日,美國半導體公司英偉達(NASDAQ:NVDA)在向美國證券交易委員會(SEC)遞交的一份監管檔案中披露,美國政府已推出一項新的出口許可管制,將影響到英偉達向中國和俄羅斯出口兩款高性能GPU產品。此次管制涉及英偉達A100和即將出貨的H100兩款晶片,以及未來推出的峰值性能等同或超過A100的其他晶片;此外,英偉達套用這些高性能GPU晶片的系統級產品,也均在美國政府新的管制範圍內。
2023年11月,英偉達的一份新檔案證實,其高端產品被實施了新的出口許可限制,禁止向包括中國在內的多個國家和地區出口旗下部分高性能產品,例如 A100、H100、A800 、H800、RTX 4090。雖然這些高性能晶片近期仍然可以運往中國,但僅限 11 月 17 日之前。

晶片套用

2025年11月初,美國初創公司Starcloud通過SpaceX火箭將第一顆搭載英偉達H100晶片的Starcloud-1衛星送入軌道。此次部署支撐了首個太空迷你數據中心的運行,並於2025年12月成功在軌道上完成人類首次大語言模型訓練(包括Gemma和NanoGPT),驗證了H100晶片在極端太空環境中的實時查詢處理能力與複雜回響生成能力。該衛星體積為冰櫃大小(重約60公斤),集成強化版H100GPU集群,採用軌道持續太陽能供電並實現高效散熱,支持太空場景大規模AI計算套用。2025年12月,Starcloud系統已將該晶片用於處理Capella Space衛星影像的實時推理,成功檢測海上翻覆船隻的救生筏及森林火災熱特徵,並提供實時救援警報。Starcloud計畫於2026年10月發射的新衛星將搭載多塊H100晶片及英偉達新一代Blackwell平台,並集成Crusoe雲平台模組,支持客戶直接部署太空AI工作負載。另一方面,在地面AI模型部署領域,2025年12月Mistral AI推出的Devstral 2 (123B)編程模型本地部署時明確要求至少需要4塊H100級GPU支持。該模型在SWE-bench Verified測試中取得72.2%的分數。另一方面,2025年12月,AI開發者David Noel Ng通過修復一台搭載雙NVIDIA GH200超級晶片(集成H100 GPU)的伺服器,成功在本地運行參數規模高達2350億的大語言模型。2025年12月,Meta公司與英偉達簽署價值50億美元的H100晶片訂單。此外,根據埃隆·馬斯克在2025年的說法,GPT-5的訓練可能需要使用30000至50000個H100晶片,每個晶片的功耗峰值為700瓦。相比之下,中國企業中科天算的極光5000星載智慧型機計畫於2026年進行在軌驗證,其搭載的國產全尺寸GPU性能對標H100。中科天算已構建包含星載智慧型機、作業系統及運算元庫的完整技術體系,其極光2000系列採用VPX架構完成研發。
2026年1月,在IndySCC學生超算競賽中,浙江大學超算隊使用H100顯示卡節點處理GPU賽題,幫助團隊奪得全球總冠軍。

規格參數

使用台積電最新的四納米工藝,採取新一代的Hopper架構,擁有800億個電晶體,也是迄今為止該公司推出的最為強大的一款GPU,將取代兩年前的Ampere架構。H100也將成為全球最大的一款加速晶片。英偉達稱這種新技術晶片可以大幅提升人工智慧算法的計算速度,其功耗峰值為700瓦,未來有望成為人工智慧基礎設施的核心,截至2025年供需穩定期,該晶片單價約為20萬元人民幣。

相關詞條

熱門詞條

聯絡我們