Step Reasoner mini

Step Reasoner mini是階躍星辰自主研發的推理模型,於2025年1月16日正式上線。該模型採用主動規劃與反思驗證機制,通過"慢思考"技術路徑對複雜問題進行多輪邏輯推演和結果校驗,在數學基準測試中超越OpenAI o1-preview模型並與o1-mini性能持平。其套用場景涵蓋邏輯推理、代碼編寫及文學創作領域,用戶可通過躍問平台進行體驗。

基本介紹

  • 研發公司:階躍星辰 
  • 上線日期:2025年1月16日 
  • 所屬系列:Step系列基座模型 
  • 核心能力:邏輯推理/數學運算 
  • 測試對標:OpenAI o1-mini
  • 訪問方式:躍問網頁端 
技術特性,套用場景,公司背景,技術布局,

技術特性

採用主動規劃、嘗試和反思的三階段推理機制,通過模擬人類"慢思考"模式提升結果可靠性。在邏輯驗證過程中設定多輪自我校驗環節,確保最終輸出經過反覆論證,該機制使模型在處理超長推理鏈問題時展現獨特優勢。
基準測試顯示,模型在2025年的AIME(美國數學邀請賽)和Math數學測試中成績超過OpenAI o1-preview 12.6%,與o1-mini達到同等水平。在LiveCodeBench代碼任務測試中效果提升達18.4%,但實測發現存在過度思考導致自我否定的現象。

套用場景

主要面向需深度邏輯推演的套用場景:
  • 解決拓撲排序、動態規劃等複雜數學問題
  • 完成代碼調試與算法最佳化任務
  • 處理"寶匣問題"類邏輯謎題
  • 支持中文語境下的文學創作
在實測案例中,模型能準確解析"蝸牛爬桿問題"的物理過程,但在比較9.9與9.11大小時出現論證瑕疵。其全程中文推理特性受到開發者社區關注。

公司背景

階躍星辰作為2023年4月成立的上海AI初創公司,採取"模型+套用"雙軌發展路線,2024年獲國資重點支持後成為國內少數同時布局語言模型與多模態模型的企業。其Step系列模型矩陣涵蓋語言理解、多模態互動及專項推理能力,旗艦產品Step-2曾入圍LMSYS大模型排行榜全球前十。

技術布局

此次發布的Step Reasoner mini標誌著該公司完成基座模型關鍵技術拼圖,形成覆蓋自然語言處理(NLP)、多模態理解(MMU)與專項推理(SR)的完整技術體系。該模型與躍問AI聊天平台構成產品矩陣,體現其"技術研發+場景落地"的商業模式。

相關詞條

熱門詞條

聯絡我們