萬卡集群

萬卡集群

萬卡集群是由超過一萬張加速卡組成的高性能計算系統,主要用於加速人工智慧模型的訓練和推理,形成支持千億至萬億參數大模型訓練的超級計算機架構。該系統通過高速RDMA網路技術實現智慧型融合分級存儲與高密度設備部署。

2024年9月,百度智慧型雲點亮國內首個自研崑崙芯三代萬卡集群。中國移動智算中心(呼和浩特)部署約2萬張AI加速卡,採用冷板液冷技術。中國電信投產上海、北京萬卡集群;杭州市數據集團建成全國首個液冷萬卡級智慧型算力集群;中國聯通計畫2024年建成首個萬卡集群。小米公司實施GPU萬卡集群搭建計畫,初期配置6500張GPU加速卡。百度智慧型雲規劃3萬卡集群建設(2025年)。2025年12月,光合組織人工智慧創新大會展示國產萬卡級智算超集群系統,基於中科曙光scaleX640超節點技術設計。2025年12月20日,摩爾執行緒發布新一代GPU架構花港,支持10萬卡以上規模智算集群。2026年1月,北京提出力爭兩年左右建成十萬卡級國產智算集群。

基本介紹

  • 技術構成:加速卡、RDMA網路、並行存儲
  • 算力指標:6.9EFLOPS(2024年) 
  • 套用領域:大模型訓練、智慧城市、工業數位化
  • 國產案例:飛星一號(2024年) 
  • 單機櫃功耗:46KW(2024年) 
  • 國際案例:GPT-4訓練需2.5萬卡(2025年)
技術架構,產業生態協同,建設挑戰,套用場景,發展趨勢,資金支持,

技術架構

萬卡集群整合超過一萬張加速卡與高速RDMA網路技術,形成單一超級計算機架構。中國移動哈爾濱智算中心採用國產化網路設備組網,實現智慧型融合分級存儲與5400餘台設備的高密度部署,哈爾濱中心單機櫃功率達46KW並套用風冷技術。中國移動智算中心(呼和浩特)部署約2萬張AI加速卡(國產化率超85%),實現6.7EFLOPS智慧型算力,採用GPU扣卡模組、高速無損網路及冷板液冷技術。中科曙光scaleX640超節點技術實現單機櫃部署640張加速卡,通過高密度集成技術提升集群能效。該技術可實現單機櫃20倍算力密度提升,其開放架構設計支持多品牌AI加速卡適配及400+主流大模型最佳化。此外,摩爾執行緒於2025年12月發布新一代GPU架構花港,具備新一代指令集,算力密度提升50%,能效提升10倍,集成全精度端到端加速技術,支持10萬卡以上規模智算集群,搭載第一代AI生成式渲染架構和第二代光線追蹤硬體加速引擎。此次推出的三款新晶片是華山、廬山和長江,分別是AI訓推一體晶片、圖形渲染晶片和SoC(系統級晶片)。新一代華山晶片支持FP4精度計算,其浮點計算能力介於英偉達Blackwell和Hopper之間,華山的訪存頻寬與Blackwell接近,高速互聯頻寬在Hopper和Blackwell之間。張建中表示,2024年摩爾執行緒推出第一代千卡集群,今年達到1萬卡,接下來還要做10萬卡、50萬卡、100萬卡。

產業生態協同

2025年12月17日至19日,光合組織將在崑山舉辦2025人工智慧創新大會(HAIC2025),聚焦AI計算開放架構創新,旨在搭建協同平台破解產業生態難題。會議期間,國產萬卡級智算超集群系統已於2025年12月18日首次以真機形式亮相,該系統依託中科曙光scaleX640超節點技術設計,支持多品牌AI加速卡適配及400+主流大模型最佳化 scaleX 萬卡超集群可支持多品牌加速卡以及主流計算生態,並實現 400+ 主流大模型、世界模型等適配最佳化,國產算力產業鏈已初步形成從存儲底座、計算集群到終端套用的生態閉環。根據2026年1月5日發布的《北京人工智慧創新高地建設行動計畫》,北京計畫力爭用兩年左右時間,建成十萬卡級國產智算集群,以提升算力自主保障能力。
當前國產AI晶片企業加速上市進程,但存在廠商設備互聯互通欠缺、軟體棧適配難度大等問題,導致資源整合效率低且運營成本高企。面對系統挑戰,分層解耦、各司其職成為行業共識,海光信息通過開放其高速互連匯流排協定(HSL),實現了海光CPU與多品牌AI加速卡的異構互聯。中國銀行作為牽頭行組建科技銀團為摩爾執行緒萬卡集群落地提供10億元資金支持,形成覆蓋企業研發、產業化和生態構建的全周期金融服務體系。
為解決軟體生態割裂問題,廠商從多路徑降低開發與使用門檻,例如摩爾執行緒推出“MTT AIBOOK”AI算力本及代碼生成大模型MUSACode,優刻得通過虛擬化與統一調度技術禁止底層硬體差異,紫光計算機推出支持本地化數據處理的AI工作站。
在政策與生態構建層面,北京市於2026年初提出將實施“開源開放聚力行動”和“安全治理護航行動”,以加強國際協同與安全保障。“開源開放聚力行動”包括高水平建設中國—上海合作組織國家人工智慧套用合作中心,組建“一帶一路”人工智慧產業聯盟。“安全治理護航行動”涵蓋建設人工智慧安全基礎設施、打造安全測試靶場等,旨在為創新主體提供安全服務。
國產算力生態在實際套用中接受檢驗,例如中國科學院高能物理研究所採用國產算力設施進行AI訓練和科學計算,國內網際網路大廠也開始更多地接納開放的國產算力架構。
與此同時,國產算力生態在2026年面臨全球存儲顆粒供應緊張、外部競爭環境變化等新挑戰。

建設挑戰

萬卡集群需解決算力效率與高密度部署難題:
  • 網路最佳化與軟硬協同提升GPU利用率,2026年,中科曙光發布scaleX萬卡超集群,採用400G原生RDMA網路用於高速互連,並指出銅纜傳輸距離限制需未來轉向矽光技術。
  • 摩爾執行緒在2025年開發者大會上進一步指出,萬卡智算集群的工程難度。
  • 軟體生態挑戰:在英偉達CUDA生態長期主導下,開發者切換至國產計算平台面臨巨大的代碼重構與學習成本;國產晶片廠商軟體棧互不兼容,接口標準各異,導致企業算力資源被切割成無法互通的孤島。雲服務商通過虛擬化和統一調度禁止底層差異,有廠商嘗試提供工具以降低遷移門檻。
  • 存儲與供應鏈挑戰:國產DRAM和NAND Flash供應商提供存儲底座,但全球存儲顆粒供應壓力巨大,影響算力集群建設與資源規劃。

套用場景

  1. 大模型訓練:
  2. OpenAI訓練GPT-4使用2.5萬張A100 GPU(2024年)
  3. 科大訊飛星火V4.0基於國產萬卡集群"飛星一號"訓練完成(2024年)
  4. 小米公司自2025年起搭建GPU萬卡集群支撐其AI大模型MiMo研發,初期已部署6500張GPU,計畫擴展至萬卡規模以提升模型訓練效率
  5. 中國科學院高能物理研究所的國家高能物理數據中心已開始採用國產算力設施(海光CPU結合海光DCU)進行AI訓練和科學計算,評價其性能“完全夠用”。
  6. 摩爾執行緒在2025年12月的開發者大會上宣布,其萬卡智算集群已實現1萬卡規模,並計畫擴展至10萬卡、50萬卡和100萬卡規模,以支持更大規模的AI大模型訓練。
  7. 北京市在2026年人工智慧創新高地建設推進會上提出,力爭兩年左右建成十萬卡級國產智算集群,以實現人工智慧基礎理論和核心技術原創能力大幅提升,並推動科學智慧型、具身智慧型發展。
  8. 產業數位化:
  9. 哈爾濱集群支撐政務AI基座、湯原縣稻田監測系統(2024年)
  10. 多領域套用:在2025年12月的HAIC2025大會上,中科曙光發布的scaleX萬卡超集群真機全球首秀,支持大模型訓練、金融風控、地質能源勘探及科學智慧型等多元場景。
  11. 摩爾執行緒在2025年12月推出了具身智慧型仿真訓練平台,進一步擴展了萬卡集群在智慧型仿真和機器人訓練等領域的套用。
  12. 北京市計畫深入推進全域套用賦能行動,在醫療、製造、教育等領域建設一批國家人工智慧套用中試基地;同時實施具身智慧型全鏈跨越行動,推動人形機器人創新套用,京津冀聯動培育千億級具身智慧型產業集群。
小米創始人雷軍明確提出手機為AI硬體核心載體(2025年11月)

發展趨勢

進入2026年,國產算力產業資本運作持續活躍,例如天數智芯於2026年1月8日在港股上市,公開發售獲超400倍認購;摩爾執行緒、沐曦股份已於2025年12月登入科創板。百度智慧型雲規劃3萬卡集群建設(2025年),中國聯通上海臨港項目將建成首個萬卡集群(2024年)。小米公司已實施GPU萬卡集群搭建計畫,初期配置6500張GPU加速卡,並計畫進一步擴大規模以支撐AI大模型研發。智算中心向超萬卡規模演進,臨港智算谷終期規劃30萬卡集群(2025年)。此外,2025年12月17日至19日,光合組織在崑山舉辦2025人工智慧創新大會(HAIC2025),國產萬卡級智算超集群系統首次以真機形式亮相,基於中科曙光scaleX640超節點技術設計,支持多品牌AI加速卡適配及400+主流大模型最佳化。中科曙光在此次大會上正式發布了scaleX萬卡超集群,該集群基於scaleX640超節點技術,實現單機櫃部署640張加速卡,通過高密度集成技術提升集群能效。同時,行業直面超大規模集群的挑戰,中國工程院院士鄭緯民指出國產十萬卡系統要做到可用、好用非常難。中科曙光在scaleX萬卡超集群中採用國產首款400G原生RDMA網路技術解決高速互連瓶頸,並指出未來需發展矽光技術以突破銅纜物理傳輸極限。此外,長鑫科技與長存集團提供的DRAM和NAND Flash存儲晶片為萬卡集群解決存儲問題。摩爾執行緒於2025年12月20日發布新一代GPU架構花港,支持10萬卡以上規模智算集群。根據開發者大會信息,摩爾執行緒在2024年推出第一代千卡集群,2025年達到1萬卡,並計畫未來擴展至10萬卡、50萬卡和100萬卡規模。展望未來,套用需求驅動硬體發展,2026年被行業視為‘Agent(智慧型體)元年’,算力消耗指數級增長,加劇供需錯配,為國產算力帶來市場機會。DeepSeek等國產大模型的特定技術需求如FP8量化反向定義硬體競爭標準。儘管面臨國際競爭不確定性,但國內政企客戶對供應鏈安全的剛性需求及初步形成的國產算力生態閉環構成產業持續發展的基本盤。

資金支持

中國銀行作為牽頭行組建科技銀團為摩爾執行緒萬卡集群落地提供10億元資金支持,精準助力企業技術攻關與量產突破。中銀集團下屬投資平台以股權投資方式積極參與摩爾執行緒A輪融資金額超億元,形成覆蓋企業研發、產業化和生態構建的全周期金融服務體系。

相關詞條

熱門詞條

聯絡我們