InternLM2-20B-WQX 是上海人工智慧實驗室於 2024 年 6 月 4 日開源的書生・浦語 2.0 系列文曲星大語言模型。
2024年6月 19 日,上海人工智慧實驗室公布了包括InternLM2-20B-WQX在內的首個 AI 高考全卷評測結果。該機構表示,Qwen2-72B、GPT-4o 及書生・浦語 2.0 文曲星(InternLM2-20B-WQX)成為本次大模型高考的前三甲,得分率均超過 70%。
基本介紹
- 中文名:書生・浦語 2.0 文曲星
- 外文名:InternLM2-20B-WQX
發展歷程,功能特點,
發展歷程
2024年6月 19 日,上海人工智慧實驗室公布了包括InternLM2-20B-WQX在內的首個 AI 高考全卷評測結果。該機構表示,Qwen2-72B、GPT-4o 及書生・浦語 2.0 文曲星(InternLM2-20B-WQX)成為本次大模型高考的前三甲,得分率均超過 70%。
功能特點
語文
模型的現代文閱讀理解能力普遍較強,但是不同模型的文言文閱讀理解能力差距較大。
大模型作文更像問答題,雖然有針對性但缺乏修飾,幾乎不存在人類考生都會使用舉例論證、引用論證、名人名言和人物素材等手法。
多數模型無法理解“本體”“喻體”“暗喻”等語文概念。語言中的一些“潛台詞”,大模型尚無法完全理解。
數學
大模型的主觀題回答相對凌亂,且過程具有迷惑性,甚至出現過程錯誤但得到正確答案的情況。
大模型的公式記憶能力較強,但是無法在解題過程中靈活引用。
英語
英語整體表現良好,但部分模型由於不適應題型,在七選五、完形填空等題型得分率較低。
大模型英語作文普遍存在因超出字數限制而扣分的情況,而人類考生多因為字數不夠扣分。
