架構簡介
CANN(Compute Architecture for Neural Networks)是華為針對AI場景推出的異構計算架構,該架構是把上層AI訓練框架((如PyTorch、TensorFlow、MindSpore等)和底層昇騰晶片連線起來的橋樑,讓開發者不用關心晶片細節就能調用底層算力,是提升昇騰AI處理器計算效率的關鍵平台。
發展歷史
2018年9月,CANN1.0華為昇騰AI使能平台誕生,2020年,CANN3.0版本發布,作為專門面向AI場景的異構計算架構,搭起了上層深度學習框架和底層AI硬體平台的橋樑。截至2024年,華為CANN計算平台已經到了7.0版本。2025年,升級到8.0版本。8月5日,昇騰計算產業發展峰會在北京召開,華為輪值董事長徐直軍在會上宣布華為昇騰硬體使能CANN全面開源開放,Mind系列套用使能套件及工具鏈全面開源,與會代表和華為共同發起了《CANN 開源開放生態共建倡議》,以凝聚產業力量,共探AI邊界,共建昇騰生態。截至2025年8月,CANN已支持包括PyTorch、MindSpore、TensorFlow、飛槳、ONNX、計圖、OpenCV和OpenMMLab等深度學習框架與第三方庫。
智譜於2025年7月28日正式開源新一代基座模型
GLM-4.5。同時在昇騰計算產業發展峰會上,
華為宣布CANN(Compute Architecture for Neural Networks)技術體系及Mind系列工具鏈全面開源開放。
智譜GLM端側模型基於CANN,已完成與昇騰和
麒麟的適配。智譜在雲側昇騰環境中開發Ascend C自定義運算元,完成模型微調與量化,並藉助CANN工具鏈實現該模型的“一步直轉”,運算元代碼直接復用,高效部署至基於麒麟晶片的端側設備,支持在PC場景中快速落地。這種創新模式大幅降低了端雲模型、運算元適配工作量,也驗證了CANN體系的開放性與研發效率。
本次合作標誌著國產大模型與計算架構在端雲協同方向實現關鍵突破,國產AI生態正加速邁入深度融合階段。
CANN是華為自研的AI計算架構,具備統一的端雲部署能力。依託昇騰、麒麟NPU硬體共架構,開發者一次開發即可面向端雲協同部署,顯著降低模型適配和運算元開發成本,提升AI能力在多平台的部署效率。GLM-4.5是智譜專為智慧型體套用打造的基礎模型,首次在單個模型中實現將推理、編碼和智慧型體能力原生融合的技術突破,綜合測試性能已躋身全球領先行列。
未來,華為和智譜將共同推進國產化大模型面向端雲協同解決方案的研發和部署,定義下一代AI生產、部署方式,進一步拓展國產計算架構和國產大模型的套用價值。
2025年8月5日,昇騰計算產業發展峰會在北京召開,會代表和華為共同發起了《CANN開源開放生態共建倡議》,以凝聚產業力量,共探AI邊界,共建昇騰生態。
2025年8月15日,據華為中國政企業務訊息,在2025華為算力場景發布會暨北京xPN夥伴大會上,華為昇騰計算領域副總裁劉偉表示2025年下半年,昇騰將實施從低算力到高算力全面覆蓋邊端場景的策略,同時,部件產品重點投入Atlas 300I A2和310模組,以此提升產品解決方案的競爭力並完善生態豐富度。CANN全面開源開放,2025年底將完成A2版本開源。
功能特點
在鴻蒙設備上,CANN面向麒麟硬體平台為各種人工智慧模型和算法提供統一的接入和運行環境。CANN構建在底層的硬體驅動和最佳化的計算庫之上,面向華為自研的達文西架構NPU的計算核心,與雲側昇騰晶片統一支持Ascend C自定義運算元程式語言和相關工具鏈,確保開發者面向NPU的開發最佳化可以一次開發、多端運行。在基礎層面,昇騰CANN實現了鴻蒙、歐拉、麒麟、紅旗、統信五大國產系統的深度連結,為生態夥伴提供硬體定製開發支持。在技術層面,昇騰CANN分層解耦架構在關鍵領域取得了突破性進展。截至2025年7月,高性能運算元庫已使能30餘家客戶/夥伴開發260+核心運算元,驅動整網性能平均提升超10%。通信算法創新方面,基於pipeline算法、NHR核算法等前沿技術實現通信效率躍升50%+。