openPangu-Ultra-MoE-718B-V1.1

openPangu-Ultra-MoE-718B-V1.1是基於昇騰NPU訓練的大規模混合專家(MoE)語言模型,總參數規模達718B,激活參數量為39B。該模型於2025年10月15日在GitCode平台正式開源,支持/no_think標記切換快思考與慢思考兩種能力運行模式,並在SuperCLUE榜單中位列開源模型總榜第三。該模型採用MLA、MTP和高稀疏比混合專家架構。2025年10月發布的V1.1版本增強工具調用能力,將幻覺率降至3.85%,同時提供Int8量化版本使其顯存占用減少約一半。

基本介紹

  • 外文名:openPangu-Ultra-MoE-718B-V1.1
  • 開源時間:2025年10月15日
簡介,發展歷史,

簡介

openPangu-Ultra-MoE-718B-V1.1是基於昇騰NPU訓練的大規模混合專家(MoE)語言模型,總參數規模達718B,激活參數量為39B。

發展歷史

2025年10月15日,openPangu-Ultra-MoE-718B-V1.1正式在GitCode平台開源,模型權重與技術細節全面公開。

相關詞條

熱門詞條

聯絡我們