無穹Infini-AI

無穹Infini-AI是由無問芯穹公司於2024年3月31日正式推出的大模型開發與服務平台,基於多晶片算力底座構建,支持異構晶片混合訓練與推理最佳化。該平台通過算法創新、模型計算最佳化等技術實現算力成本降低,在英偉達GPU和AMD晶片上可提升2-4倍推理速度,並提供百億tokens免費配額以推動AI普及。創始團隊由清華大學電子工程系教授汪玉及多位科技企業高管組成,已與燧原科技、智譜AI等企業達成戰略合作,構建覆蓋模型開發、訓練、部署的一站式服務體系。

基本介紹

  • 開發者:無問芯穹(上海無問芯穹智慧型科技有限公司)  
  • 上線時間:2024年3月31日  
  • 免費配額:百億tokens(面向實名用戶)  
  • 支持模型:20餘種(含Baichuan2、ChatGLM等)  
  • 支持晶片:10餘種(含AMD、華為昇騰等)   
  • 創始人:汪玉、夏立雪、顏深根   
技術架構,核心功能,發展歷程,創始團隊,戰略合作,

技術架構

平台採用算法創新、模型計算最佳化、平台最佳化和硬體推理最佳化的四層技術架構,自主研發的FlashDecoding++技術可使GPU推理速度最高提升400%。通過構建模型-晶片中間層,實現AMD、英偉達、華為昇騰等異構晶片的混合訓練部署,2024年7月千卡異構集群算力利用率達到97.6%,支持萬卡規模擴展。

核心功能

  • 算力成本最佳化: 提供彈性算力方案,通過軟硬體協同最佳化降低推理成本,典型客戶案例顯示推理加速效果顯著。
  • 一站式開發服務: 支持模型精調、部署及可視化操作,允許第三方模型無縫遷移,並提供定製化計費方案。
  • 多晶片兼容: 支持AMD、摩爾執行緒、天數智芯等6種晶片混合訓練,覆蓋20餘個主流大模型。

發展歷程

  • 2024年3月31日: 平台正式發布並開放全量註冊,向實名用戶提供百億tokens免費配額。
  • 2024年7月: 實現全球首個千卡異構混合訓練集群,算力利用率突破97.6%。
  • 2024年9月: 成為智譜AI、月之暗面等頭部大模型公司的算力服務供應商。

創始團隊

由清華大學電子工程系教授汪玉發起,核心成員包括:
  • 夏立雪(CEO): 汪玉首位博士生,前阿里雲高管,負責算法最佳化與商業化落地。
  • 顏深根(CTO): 前商湯科技總監,主導AI系統架構設計。
  • 戴國浩(首席科學家): 清華大學電子系博士,專注於硬體研發與異構計算。

戰略合作

平台已與燧原科技、摩爾執行緒達成系統級融合,支持調用其千卡集群資源;2024年與智譜AI共建萬卡訓推集群,並計畫2025年推出基於FPGA的低成本LPU晶片。典型落地案例包括同道獵聘的AI數字人面試官套用,通過平台實現推理成本最佳化與回響速度提升。

相關詞條

熱門詞條

聯絡我們