Qwen3-Embedding

Qwen3-Embedding(全稱:千問3向量模型)是阿里巴巴集團於2025年6月6日開源的多語言文本嵌入模型系列,屬於通義千問3技術體系的核心組件。該系列包含0.6B、4B和8B三種參數規模,支持119種語言文本向量化,覆蓋文本表征、檢索與排序等任務。

該模型基於Qwen3基礎模型架構構建,採用三階段訓練流程:大規模弱監督預訓練、高質量數據監督微調及模型融合技術。其8B版本在MTEB多語言基準測試中以70.58分位列榜首,支持自定義嵌入維度(64-4096維)和指令模板最佳化。技術實現包含雙編碼器結構、LoRA微調策略,提供ModelScope、Hugging Face等開源平台部署方案,適用於RAG系統、企業知識庫管理等場景

基本介紹

  • 外文名:Qwen3-Embedding
  • 簡稱:千問3向量模型
  • 開源單位:阿里
  • 時間:2025年6月6日
發展歷史,性能表現,

發展歷史

2025年6月6日,阿里開源通義千問3全新的向量模型系列 Qwen3-Embedding(簡稱千問3向量模型)。該模型以千問3為底座,專門為文本表征、檢索和排序等核心任務進行最佳化訓練,性能較上一版本可提升 40%。

性能表現

該模型以千問3為底座,專門為文本表征、檢索和排序等核心任務進行最佳化訓練,性能較上一版本可提升40% ,在MTEB等權威專項榜單中超越了谷歌、OpenAI、微軟等公司的頂尖模型,攬獲同類模型的SOTA最佳性能表現。

相關詞條

熱門詞條

聯絡我們