Qwen2.5-14B-Instruct-1M是阿里雲通義千問Qwen團隊於2025年1月推出的開源大語言模型,首次實現了原生支持百萬Token級別的長文本處理能力,通過Dual Chunk Attention機制將上下文長度擴展至1M,並基於vLLM引擎集成稀疏注意力機制實現推理效率提升。該模型在RULER、LV-Eval等長文本基準測試中表現出色,能夠精準完成書籍解析、法律檔案分析等複雜任務。作為開源生態的重要組成,其代碼與模型權重已在魔搭社區、HuggingFace等平台發布。
基本介紹
- 發布時間:2025年1月
- 參數規模:140億
- 上下文長度:1M Token
- 核心技術:稀疏注意力機制
- 開源平台:ModelScope、HuggingFace
- 基準測試:RULER、LV-Eval
技術架構與創新
性能表現與套用場景
- 長文檔解析:支持整本圖書(約50萬字)的語義分析與關鍵信息抽取
- 專業領域處理:可連續處理超百萬Token的法律契約條款比對與合規審查
- 互動式套用:實現長達20小時的多輪對話記憶保持能力
開源生態與開發者支持
- 長文本增強版:專注100K-1M長度輸入的推理最佳化
- 通用增強版:平衡長短文本處理能力,保持與128K版本相當的通用任務性能
