KUAE是由摩爾執行緒研發的全國產千卡千億模型訓練平台,於2023年12月19日正式揭牌運行。該平台以全功能GPU為硬體底座,內置數千張MTT S4000智算加速卡,支持700億至1300億參數規模的大模型訓練與推理任務。通過MTLink 1.0技術實現多卡互聯,單卡提供48GB顯存和768GB/s頻寬,整體集群可輸出300P算力。
2024年4月,摩爾執行緒與無問芯穹達成戰略合作,基於KUAE平台實現LLama2-70B大模型的訓練測試。同年5月完成3B規模大模型實訓,千卡擴展效率超90%,訓練穩定性達100%。平台採用軟硬一體化交付模式,融合分散式框架最佳化與CUDA代碼遷移技術,形成從硬體集群到套用服務的完整解決方案。
基本介紹
- 所屬公司:摩爾執行緒
- 發布時間:2023年12月19日
- 硬體底座:MTT S4000 GPU集群
- 參數支持:700-1300億
- 核心技術:MTLink 1.0互聯
- 生態聯盟:PES-KUAE智算聯盟
技術架構與硬體配置
核心功能特性
- 支持700億至1300億參數大模型訓練,以2000億訓練數據量為例:700億模型訓練周期33天,1300億模型需56天
- 實現CUDA代碼零成本遷移至MUSA平台,配備MUSIFY開發工具鏈
- 融合數據並行、流水線並行與張量並行策略,最佳化Flash Attention運算效率
- 支持模型推理服務部署,提供動態批處理與顯存最佳化技術
