MiniMax-M1

MiniMax-M1是上海AI企業MiniMax(稀宇科技)於2025年6月17日在世界人工智慧大會(WAIC)上發布的開源大規模混合架構推理模型。

該模型採用混合門控專家架構(MoE)與Lightning Attention注意力機制相結合的創新設計,支持100萬Token的上下文輸入和8萬Token的推理輸出能力,與谷歌Gemini 2.5 Pro的長文本處理能力持平。模型通過CISPO強化學習算法最佳化訓練效率,使用512塊H800 GPU進行三周訓練,租賃成本約53.5萬美元。其架構創新使8萬Token推理算力需求僅為DeepSeek R1的25%。提供階梯式API定價策略(0.8-24元/百萬Token),自有平台不限量免費使用,模型權重及技術文檔通過Hugging Face/GitHub開源。在SWE-bench代碼驗證基準測試中取得55.6%-56.0%的成績,長文本理解能力全球排名第二,工具調用場景領跑開源模型。

基本介紹

  • 中文名:MiniMax-M1
  • 所屬品牌:MiniMax
  • 產品類型:推理模型
  • 發布時間:2025年6月17日
發展歷程,產品優勢,

發展歷程

2025年6月17日,MiniMax發布新模型MiniMax-M1,稱其為世界上第一個開源的大規模混合架構的推理模型,在面向生產力的複雜場景中能力是開源模型中的最好一檔,超過國內的閉源模型,接近海外的最領先模型,同時又有業內最高的性價比。

產品優勢

M1的優勢是支持目前業內最高的100萬上下文的輸入,跟閉源模型裡面的Google Gemini 2.5Pro一樣,是DeepSeek R1的8倍,以及業內最長的8萬Token的推理輸出。
軟體工程、長上下文與工具使用等面向生產力的複雜場景中,模型具備顯著優勢。
MiniMax-M1-40k 和 MiniMax-M1-80k 在 SWE-bench 驗證基準上分別取得 55.6% 和 56.0% 的優異成績,這一成績略遜於 DeepSeek-R1-0528 的 57.6%,但顯著超越其他開源權重模型。
依託其百萬級上下文視窗,M1 系列在長上下文理解任務中表現卓越,不僅全面超越所有開源權重模型,甚至超越 OpenAI o3 和 Claude 4 Opus,全球排名第二,僅以微弱差距落後於 Gemini 2.5 Pro。
在代理工具使用場景(TAU-bench)中,MiniMax-M1-40k 同樣領跑所有開源權重模型,並戰勝 Gemini-2.5 Pro。

相關詞條

熱門詞條

聯絡我們