Xiaomi MiMo-V2-Flash

Xiaomi MiMo-V2-Flash是小米自研的混合專家(MoE)大語言模型,總參數309B(激活15B),專注於推理效率。

2025年12月17日,在小米合作夥伴大會上正式開源。

模型負責人為羅福莉,她於2025年下半年加盟小米並擔任MiMo大模型負責人。

12月24日,雷軍介紹小米自研開源模型MiMo-V2-Flash。

代碼能力比肩標桿閉源模型Claude Sonnet 4.5,但推理價格僅為其2.5%。

在多個Agent測評基準上躋身“全球開源模型TOP2”。

推理速度為150 tokens/秒,成本為每百萬token輸入0.1美元、輸出0.3美元。

通過引入Hybrid注意力架構創新及多層MTP推理加速,實現推理效率提升。

MiMo模型將成為連線“人車家”三端的“智慧型大腦”。

基本介紹

  • 中文名:Xiaomi MiMo-V2-Flash
  • 開源時間:2025年12月17日
發展歷史,模型特性,簡介,生態套用,

發展歷史

2025年下半年,羅福莉加盟小米並擔任MiMo大模型負責人,她在2025年12月17日小米合作夥伴大會上首次公開亮相。研發團隊圍繞智慧型體溝通效率、頻寬和後訓練潛能三個核心問題展開工作。
2025年12月17日,Xiaomi MiMo-V2-Flash正式開源。它是小米自研的混合專家(MoE)大語言模型,專注於推理效率,在代碼與Agent能力、生成速度和推理成本方面表現突出。
2025年12月24日,小米創辦人、董事長兼CEO雷軍在微博上介紹了MiMo-V2-Flash模型,強調了其在推理效率方面的創新和性能。

模型特性

超強的代碼和工具調用能力:這是Agent溝通的高效“語言”;在多個Agent測評基準上躋身“全球開源模型TOP2”。
圍繞推理效率設計模型結構:通過引入Hybrid注意力架構創新及多層MTP推理加速,這是“高頻寬”的Agent協作的關鍵;採用3層MTP推理加速並行Token驗證,實現了2.0-2.6倍的推理速度提升。具體而言,該模型的推理速度達到150 tokens/秒,成本為每百萬token輸入0.1美元、輸出0.3美元。在回響速度測試中,同樣深度思考下,小米MiMo只需要不到3秒就能做出回應,而DeepSeek用時15秒。
全新後訓練範式:可高效穩定的擴展強化學習訓練。

簡介

Xiaomi MiMo-V2-Flash是小米自研的總參數309B(激活15B)的MoE模型,代碼能力比肩標桿閉源模型Claude Sonnet 4.5,但推理價格僅為其2.5%。小米集團總裁盧偉冰將其稱為“邁向Agent時代的全新語言基座”。在多個Agent測評基準上,該模型躋身全球開源模型TOP2。性能可以媲美DeepSeek-V3.2、Kimi-K2等頭部開源模型。

生態套用

MiMo模型將成為連線“人車家”三端的“智慧型大腦”,通過統一多模態感知能力為理解物理世界打下基礎。
適配車型包括比亞迪方程豹鈦7和廣汽豐田鉑智7,汽車製造商比亞迪、廣汽豐田、長城、鄭州日產已加入CarloT生態。
CarloT生態開放時間節奏為2024年布置物理接口,2025年開放家控車,2026年開放車控家,2027年推出車載中樞網關。
下一代智慧型體系統應理解人類世界並與之共存,具備記憶、推理、自主規劃等能力。

相關詞條

熱門詞條

聯絡我們