TeleAI-t1-preview是由中國電信人工智慧研究院(TeleAI)研發的複雜推理大模型,於2025年1月24日正式發布。該模型聚焦數學推導與邏輯推理任務,採用強化學習訓練方法,引入探索、反思等思考範式提升推理準確性。
在美國數學競賽AIME 2024和MATH500評測中,TeleAI-t1-preview分別以60分和93.8分超越OpenAI o1-preview及GPT-4o。其在美國研究生級別問答測試GPQA Diamond中表現優於GPT-4o,達到Claude 3.5 Sonnet水平。訓練過程中構建數學為核心的多學科推理數據集,通過蒙特卡洛樹搜尋生成高質量思維鏈數據,並新增基於規則的獎勵模型最佳化推理能力。模型支持解題過程可視化,可轉換《九章算術》文言題目為現代漢語並完成古今單位換算。
基本介紹
- 外文名:TeleAI-t1-preview
- 發布單位:中國電信人工智慧研究院
發展歷史,工作原理,
發展歷史
2025年1月,TeleAI-t1-preview正式發布。在美國數學競賽AIME 2024、MATH500兩項數學基準評測中,TeleAI-t1-preview分別以60和93.8分的成績,超過OpenAI o1-preview、GPT-4o等標桿模型。在研究生級別問答測試GPQA Diamond中,TeleAI-t1-preview得分超過 GPT-4o。
工作原理
TeleAI-t1-preview使用了強化學習訓練方法,通過引入探索、反思等思考範式,提升模型在數學推導、邏輯推理等複雜問題的準確性。
