Qwen3

Qwen3

Qwen3(千問3),是阿里巴巴開源的新一代通義千問模型,2025年4月29日發布。

2025年4月,阿里巴巴通義千問發布新版Qwen3系列模型;4月29日,通義App與通義網頁版全面上線Qwen3;6月6日,阿里巴巴開源了Qwen3-Embedding系列模型(Embedding 及 Reranker)。

在架構上,Qwen3是中國國內首個“混合推理模型”,“快思考”與“慢思考”集成進同一個模型;採用混合專家(MoE)架構,包含2款30B、235B的MoE模型,6款密集模型,參數量從0.6B到235B;參數量為DeepSeek-R1的1/3,激活僅需22B,預訓練數據量達36T。在推理、指令遵循、工具調用、多語言能力等方面均大幅增強,即創下所有國產模型及全球開源模型的性能新高;部署成本還大幅下降,僅需4張H20即可部署千問3滿血版,顯存占用僅為性能相近模型的三分之一。首次支持119多種語言,開源後,用戶可在魔搭社區、HuggingFace等平台下載模型並商用,也可以通過阿里雲百鍊調用千問3的API服務。Qwen3-Embedding和Qwen3-Reranker是專為文本表征、檢索與排序任務設計,基於Qwen3基礎模型訓練,充分繼承了Qwen3在多語言文本理解方面的優勢,支持119種語言; Qwen3-Embedding系列提供從0.6B到8B參數規模的3種模型配置;具備強大的多語言、跨語言及代碼檢索能力,能夠有效應對多語言場景下的數據處理需求。

基本介紹

  • 中文名:千問3
  • 外文名:Qwen3
  • 所屬:阿里巴巴通義千問 
  • 產品類型:混合推理模型
  • 發布時間:2025年4月29日
  • 開發商:阿里巴巴 
  • 參數量:0.6B到235B 
  • 登錄平台:魔搭社區、HuggingFace等
發展歷史,功能簡介,

發展歷史

2025年4月,阿里巴巴通義千問發布新版Qwen3系列模型,包括2個MoE模型和6個dense模型,參數量從0.6B到235B。4月29日,通義App與通義網頁版全面上線阿里新一代通義千問開源模型Qwen3。6月6日,阿里開源了 Qwen3-Embedding 系列模型(Embedding 及 Reranker),專為文本表征、檢索與排序任務設計,基於 Qwen3 基礎模型進行訓練。6月9日訊息,阿里通義千問 3 大模型開源僅一個月全球累計下載量突破 1250 萬。在 Hugging Face、魔搭社區和 Ollama 等主流AI開源平台上,千問 3 的 0.6B、8B、30B 和 32B 四種尺寸模型下載量均突破百萬。
2025年7月22日訊息,通義千問更新了旗艦版Qwen3模型,推出Qwen3-235B-A22B-FP8非思考模式(Non-thinking)的更新版本,命名為:Qwen3-235B-A22B-Instruct-2507-FP8。新的Qwen3模型,通用能力顯著提升,包括指令遵循、邏輯推理、文本理解、數學、科學、編程及工具使用等方面。

功能簡介

截至2025年4月,旗艦模型Qwen3-235B-A22B在編碼、數學、通用能力等基準評估中取得了有競爭力的結果。Qwen3模型推理能力大幅提升,在數學、代碼和邏輯推理等評測中,達到同規模業界SOTA水平。
阿里巴巴表示,Qwen3系列支持119種語言,並基於近36萬億個token(標記)進行訓練,使用的數據量是Qwen2.5的兩倍。阿里巴巴稱,Qwen3的訓練數據包括教材、問答對、代碼片段等多種內容。Qwen3在調用工具(tool-calling)、執行指令以及複製特定數據格式等能力方面表現出色,推薦用戶使用Qwen-Agent來充分發揮Qwen3的Agent能力。Qwen-Agent內部封裝了工具調用模板和工具調用解析器,大大降低了代碼複雜性。
用戶可以第一時間在通義App和網頁版中的專屬智慧型體“千問大模型”,以及主對話頁面,體驗到全球最強開源模型的智慧型能力。

相關詞條

熱門詞條

聯絡我們