T1(騰訊混元研發的深度思考模型)

本詞條是多義詞,共11個義項
更多義項 ▼ 收起列表 ▲

T1是騰訊混元團隊研發的深度思考模型,於2025年2月17日首次在騰訊元寶平台灰度測試,2025年3月21日發布正式版。該模型採用Hybrid-Mamba-Transformer融合架構,通過混合Mamba組件降低傳統Transformer結構的計算複雜度,實現訓練推理成本顯著下降。在MMLU-PRO測試集中取得87.2分,CEval、AIME等基準測試表現達到行業領先水平。

T1專項最佳化了數學、邏輯推理及長文處理能力,支持最高80 tokens/s的回響速度,有效解決長文本推理中的上下文丟失問題。2025年3月上線騰訊雲API服務,輸入與輸出定價分別為每百萬tokens 1元和4元。

基本介紹

  • 發布日期:2025年3月21日 
  • 開發機構:騰訊混元團隊  
  • 架構類型:Hybrid-Mamba-Transformer 
  • MMLU-PRO得分:87.2分 
  • 輸入價格:1元/百萬tokens 
  • 輸出價格:4元/百萬tokens 
技術架構,性能表現,商業化套用,評測結果,

技術架構

模型採用Hybrid-Mamba-Transformer融合結構,首次在工業界實現超大型推理模型中無損套用混合Mamba架構的技術突破。通過減少KV-Cache記憶體占用,相較傳統Transformer降低30%訓練成本,首字回響時間最佳化至秒級。在同等參數量下實現了2倍解碼速度提升,支持最高80 tokens/s的吐字速度。

性能表現

在權威評估數據集MMLU-PRO中獲得87.2分,排名僅次於o1模型。中文基準測試CEval準確率達83.6%,數學競賽級測試AIME分數超越同期80%競品。針對Zebra Logic等邏輯推理專項測試,展現出超越行業平均水平的歸納演繹能力。

商業化套用

2025年3月通過騰訊雲開放API調用服務,輸入輸出單價分別為1元/百萬tokens和4元/百萬tokens。集成於騰訊元寶平台後,可精準調取微信公眾號等生態內容,支持跨平台信息整合與多任務並發處理。

評測結果

據2025年6月新浪網評測數據顯示,在模擬"AI獲得人類身體24小時"的開放性命題測試中,T1綜合得分處於第三梯隊。DeepSeek-R1-0528模型的標準化評分顯示,其立意、邏輯性等維度得分較Claude 4 Opus等國際領先模型存在20%以上差距。評測指出該模型在哲學思辨與情感共鳴場景仍有最佳化空間。

相關詞條

熱門詞條

聯絡我們