Qwen2.5,是阿里雲研發的通義千問系列開源大模型。該系列提供Base和Instruct等多版本、多規模的開源模型,從而滿足不同的計算需求。PAI已對該系列模型進行全面支持,本文以通義千問2.5-7B-Instruct模型為例為您介紹如何在Model Gallery中部署、微調和評測該系列模型(本文適用於Qwen2.5和Qwen2系列模型)。
基本介紹
- 外文名:Qwen2.5
- 產品類型:通義千問系列開源大模型
模型簡介,運行環境,
模型簡介
Qwen2.5是阿里雲最新推出的開源大型語言模型系列,相比Qwen2,新版本在多個方面實現了顯著提升,包括知識掌握、編程能力、數學能力以及指令執行等。
- 在知識掌握上,Qwen2.5在MMLU評測中獲得了85+的高分。
- 編程能力方面,HumanEval評測達到了85+,顯示出顯著提升。
- 數學能力在MATH評測中同樣有了大幅提升,達到80+。
- 改進了指令執行能力,能夠更好地生成長文本(超過8K標記)。
- 在理解和生成結構化數據(如表格、JSON)方面表現出色。
- 增強了對各種system prompt的適應性,提升了角色扮演和聊天機器人的條件設定功能。
- 支持上下文長度高達128K tokens,並能生成最多8K tokens的內容。
- 繼續支持包括中文、英文、法文、西班牙文、葡萄牙文、德文、義大利文、俄文、日文、韓文、越南文、泰文、阿拉伯文等在內的29種以上語言。
運行環境
- 本示例目前支持在華北2(北京)、華東2(上海)、華南1(深圳)、華東1(杭州)、華北6(烏蘭察布)等地域使用Model Gallery模組運行。
