Claude Opus 4.1

Claude Opus 4.1

Claude Opus 4.1是Anthropic公司於2025年8月6日推出的新一代人工智慧模型,作為Claude 4系列的直接升級版本,通過Claude Code、Anthropic API、亞馬遜Bedrock和谷歌雲Vertex AI平台向用戶開放。

該模型聚焦編碼能力、邏輯推理精度及複雜任務處理效率的提升,新增細節追蹤與代理搜尋功能最佳化,支持200K上下文視窗和混合推理模式。2025年9月24日起集成至微軟Microsoft 365 Copilot的Researcher和Copilot Studio模組,並在Visual Studio、JetBrains IDEs、Xcode和Eclipse開發環境中提供公開預覽。模型在SWE-bench Verified軟體工程評估中取得74.5%的準確率,較前代版本提升2個百分點,TAU-bench代理終端編程測試得分43.3%(較前代提升4.1%),GPQA Diamond研究生級推理測試得分80.9%。企業用戶反饋顯示其能精準定位大型代碼庫錯誤並避免引入新bug,初級開發者基準測試提升幅度達標準差單位級別,日本樂天集團套用該模型完成20萬行代碼重構節省92%時間成本。API定價維持每百萬輸入Token 15美元、輸出75美元,支持提示快取與批處理成本最佳化,開發者可通過更換模型標識符實現無縫升級。

2025年8月25日至28日期間因推理堆疊推送導致回響質量下降,後經版本回滾恢復性能。

基本介紹

  • 中文名:Claude Opus 4.1
  • 所屬公司:Anthropic
發展歷史,模型簡介,

發展歷史

2025年8月6日,Anthropic公司發布公告,宣布推出 Claude Opus 4.1 模型,相比較2025年 5 月推出的 Claude 4 系列模型,主要改進了編碼、推理和執行指令的能力。
2025年8月6日, Claude Opus 4.1 模型面向 Claude 客戶開放,可以通過 Claude Code、Anthropic 的 API、亞馬遜 Bedrock 和谷歌雲的 Vertex AI 使用。
2025年11月19日,Anthropic與微軟擴大戰略合作,Claude Opus 4.1作為首批集成模型之一正式上線Microsoft Foundry平台公測,開發者可通過該平台的API及工具鏈(包括Python/TypeScript/C#SDK)在Azure生態中部署,並與Microsoft365 Copilot深度集成,支持Excel公式生成等企業級場景套用。

模型簡介

Claude Opus 4.1 在 SWE-bench Verified 上(用於評估軟體工程準確性)提升到了 74.5%,作為對比,Claude Sonnet 3.7 的準確率為 62.3%,而 Claude Opus 4 的準確率為 72.5%。更新後的模型在“深度研究和數據分析技能,尤其是在細節追蹤和代理搜尋方面”表現得更加出色。

相關詞條

熱門詞條

聯絡我們