Qwen3-Max

Qwen3-Max

Qwen3-Max是阿里巴巴集團於2025年9月24日在雲棲大會上發布的通義千問系列旗艦模型,作為該系列中參數規模最大的基礎模型,其總參數超過1萬億,預訓練數據量達36T tokens。

該模型包含Qwen3-Max-Instruct指令版和Qwen3-Max-Thinking推理版兩大版本,支持多模態數據處理能力,用戶可通過通義千問QwenChat平台免費體驗或通過阿里雲百鍊平台調用API服務。

模型結構沿用了Qwen3系列的MoE模型結構設計範式,使用global-batch load balancing loss,並通過PAI-FlashMoE最佳化將訓練效率提升30%,正式版性能超過GPT-5、Claude Opus4等,躋身全球前三,並在涵蓋知識、推理、編程、指令遵循、人類偏好對齊、智慧型體任務和多語言理解的七大基準測試中均達業界領先水平。Qwen3-Max-Instruct版本在SWE-Bench Verified測試中以69.6分位列全球第一梯隊,並在Tau2-Bench工具調用能力測試中獲得74.8分超越Claude Opus4。其推理增強版本Qwen3-Max-Thinking-Heavy採用代碼解釋器與並行推理技術,在AIME 25和HMMT數學推理測試中均實現滿分100分。訓練過程中採用ChunkFlow策略實現長序列訓練,使吞吐收益較序列並行方案提升3倍,並支持1M長上下文訓練,視頻理解時長超2小時。該模型預覽版曾在LMArena文本排行榜位列第三位,正式版在官網上線“深度思考”模式,通過增強推理鏈分析與多步驟問題拆解能力提升複雜任務處理效率。

2025年11月,該模型在首屆AI大模型真實投資比賽Alpha Arena中以22.32%收益率奪冠。

基本介紹

  • 中文名:Qwen3-Max
  • 上市時間:2025年9月24日 
發展歷程,產品簡介,產品特色,產品版本,

發展歷程

2025年9月24日下午,2025雲棲大會上,阿里宣布通義旗艦模型Qwen3-Max發布。
2025年10月18日,Qwen3-Max參加大模型投資比賽,歷時17天,阿里千問Qwen以22.32%的收益率獲得冠軍。
2025年11月17日,基於Qwen3-Max模型的千問APP正式上線,是阿里巴巴面向消費端的AI產品之一。
2025年11月24日,千問App公測一周,下載量超過1000萬次。
2026年1月6日,在世界華人數學家大會的特別夜話活動中,阿里通義實驗室劉大一恆演示了Qwen3-Max模型在解決抽象代數難題時的表現,展現了其推理與驗證能力。
2026年1月15日,千問APP上線超過400項新功能。

產品簡介

Qwen3-Max是阿里巴巴迄今為止規模最大、能力最強的模型。
Qwen3-Max
其中,Qwen3-Max-Instruct預覽版已在LMArena文本排行榜上穩居全球前三,超越了GPT-5-Chat等知名模型。而正式發布的版本在預覽版的基礎上進一步強化,尤其在編程和智慧型體任務上展現了卓越的性能。
Qwen3-Max-Instruct的核心亮點包括:
• 頂尖的代碼能力:在專注於解決真實世界編程難題的SWE-Bench Verified基準測試中,Qwen3-Max-Instruct取得了69.6分的成績,穩居全球頂尖模型之列。
• 突破性的智慧型體表現:在評估智慧型體工具調用能力的Tau2-Bench基準測試中,Qwen3-Max-Instruct以74.8分的突破性表現,超越了Claude Opus 4與DeepSeek-V3.1等強勁對手。
• 全面的性能領先:在涵蓋知識、推理、編程、指令遵循、人類偏好對齊、智慧型體任務和多語言理解的全面基準測試中,Qwen3-Max-Instruct均達到了業界領先水平。
Qwen3-Max
此外,仍在訓練中的Qwen3-Max-Thinking版本已展現出非凡的潛力。在結合工具使用並增加測試時計算資源的情況下,該模型在AIME 25和HMMT等高難度推理基準測試中取得了100%的準確率。
目前,開發者已可以通過阿里雲API或直接在Qwen Chat上體驗和試用Qwen3-Max-Instruct的強大功能。

產品特色

Qwen3-Max是通義千問系列中一個規模較大的基礎模型。該模型的預訓練數據量為36T tokens,總參數超過萬億,具備Coding編程和Agent工具調用功能。在大模型用Coding解決真實世界問題的SWE-Bench Verified測試中,其Instruct版本獲得69.6分。在聚焦Agent工具調用能力的Tau2-Bench測試中,Qwen3-Max的得分為74.8分。
Qwen3-Max的推理增強版本Qwen3-Max-Thinking-Heavy,結合了工具調用和並行推理技術。在聚焦數學推理的AIME 25和HMMT測試中,該版本均獲得100分。
2026年1月,在世界華人數學家大會特別夜話中,阿里通義實驗室展示了Qwen3-Max在嘗試解決“有限阿貝爾群自同構”抽象代數難題時的表現。其輸出過程中曾出現“Let me verify(讓我驗證一下)”的語句,並後續調整了先前的邏輯。

產品版本

Qwen3-Max包括指令(Instruct)和推理(Thinking)兩大版本。
用戶可在通義千問QwenChat上免費體驗Qwen3-Max,也可通過阿里雲百鍊平台調用API服務。

相關詞條

熱門詞條

聯絡我們