Claude 3.7 Sonnet

Claude 3.7 Sonnet

Claude 3.7 Sonnet是人工智慧公司Anthropic於2025年2月推出的首款混合推理模型,由姚順宇參與研發。

該模型整合快速回響與擴展分步思考兩種模式,支持通過API參數(如thinking_budget)調控思考鏈長度,具備200K token超長上下文處理能力。在SWE-Bench Verified代碼測試中基礎得分62.3%(框架調整後70.3%),HumanEval基準測試Pass@1達86%,GPQA測試擴展思維模式準確率84.8%。開發者可通過API精細控制模型思考時長(最高128K token),付費用戶可激活擴展思維模式展現完整思維鏈。同步推出的代理編碼工具Claude Code(研究預覽版)支持終端指令操作,實現代碼搜尋、編輯、測試及GitHub集成,測試中可一次性完成45分鐘以上開發任務。模型定價為每百萬輸入token 3美元、輸出token 15美元。

截至2025年,Anthropic以615億美元估值完成由Lightspeed Venture Partners領投的35億美元E輪融資。

基本介紹

  • 發布時間:2025年2月25日   
  • 定價模式:每百萬輸入token 3美元,輸出token 15美元 
  • 開發工具:Claude Code命令行工具 
  • 測試成績:HumanEval優異表現 
  • 模式創新:深度思考與實時輸出融合 
技術特點,性能表現,套用工具,融資與發展,

技術特點

作為首款混合推理模型,Claude 3.7 Sonnet無需切換即可同時具備實時回響與深度推理能力。用戶可通過API自定義思考鏈長度,實現速度與準確性平衡。模型模仿人類思維模式,整合快速直覺反應和邏輯分析功能。
Claude 3.7 Sonnet
Claude 3.7 Sonnet

性能表現

在SWE-Bench Verified測試中,基礎得分從49.0%提升至62.3%(特定框架調整後達70.3%)。MMLU、GSM8K等基準測試顯示其數學與代碼能力顯著最佳化。擴展思維模式有效提升科學任務處理精度。

套用工具

2025年3月推出的Claude Code命令行工具(研究預覽版)支持終端指令,開發者可直接委託工程任務給模型完成。工具涵蓋代碼搜尋、版本編輯與自動測試等環節。

融資與發展

截至2025年,Anthropic以615億美元估值完成35億美元融資,資金用於模型研發與市場擴展。混合推理模式被視為解決傳統AI速度精度矛盾的行業標桿。

相關詞條

熱門詞條

聯絡我們