Baichuan-M1-preview是百川智慧型於2025年1月24日發布的全場景深度思考模型,首次在國內實現語言、視覺和搜尋三大領域的跨模態推理能力整合。該模型在數學、代碼等權威評測中超越o1-preview,視覺推理能力超過GPT-4o與Claude3.5 Sonnet,並在醫療場景中通過自建億級循證醫學知識庫實現端到端服務能力。同步發布的Baichuan-M1-14B開源模型在醫學評測中表現超越Qwen2.5-72B,展現出垂直領域技術突破。
基本介紹
- 發布時間:2025年1月24日
- 開發商:百川智慧型
- 核心技術:多模態融合架構
- 套用場景:醫療循證/科研分析/軟體開發
- 性能對比:超越o1-preview
- 開源版本:Baichuan-M1-14B
技術特性,醫療循證模式,性能表現,開源生態,商業套用,
技術特性
- 通過多模態融合架構實現語言、視覺和搜尋三大領域的深度推理能力整合,突破傳統單模態模型的技術邊界
- 構建三階段領域提升訓練方案,結合ELO強化學習最佳化思維鏈路徑,提升模型邏輯推理質量
- 每日動態更新億級循證醫學知識庫(截至2025年1月),涵蓋醫學論文、臨床指南、病例報告等專業數據
醫療循證模式
- 建立包含萬億級token的醫療專業數據集,生成超千億token合成數據強化推理能力
- 通過多層級證據分級體系與實時檢索技術,提供從證據檢索到深度推理的端到端服務
- 在cmexam、clinicalbench_hos等醫學評測中,模型表現超越Qwen2.5-72B-Instruct,接近o1-mini水平
性能表現
- 數學推理:在AIME、Math等基準測試中成績超過o1-preview約15.3%
- 視覺推理:MMMU-val評測得分領先GPT-4o模型7.6個百分點,MathVista測試超越Claude3.5 Sonnet
- 代碼生成:LiveCodeBench任務處理效率較o1-preview提升22%,但複雜推理場景仍落後DeepSeek-R1
開源生態
- 配套發布Baichuan-M1-14B開源模型,參數規模14B但醫療能力達到72B量級模型的1.8倍
- 開源版本支持顯式思維鏈可視化功能,增強醫療推理過程的可解釋性
- 通過分級訓練方案適配不同算力環境,降低醫療機構部署門檻
商業套用
- 已集成至百小應平台,覆蓋臨床輔助決策、醫學影像分析、科研文獻解析三大套用場景
- 在藥企合作案例中,縮短藥物靶點篩選周期約40%,提升臨床試驗方案設計效率34%
- 支持實時檢索全球最新醫學進展,數據更新延遲控制在24小時以內
