Claude Sonnet 5 是 Anthropic 在 2026 年 6 月釋出的 Sonnet。它面向規模化 Agent:規劃、瀏覽器與終端工具、自主推進到結果;官方稱在多項 Agent 評測上明顯強於 Claude Sonnet 4.6,部分深度設定可接近 Claude Opus 4.8。需要 Opus 上限時看 Claude Opus 5;單次極長、極難任務可對照 Claude Fable 5。在 iMini Agent 裡選 Claude Sonnet 5 即可使用。
廠商
Anthropic
釋出
2026 年 6 月
上下文
1M tokens
最大輸出
128K tokens
深度思考
檔位可調
適合作為
高頻 Agent 與日常編程主力
相對 Claude Sonnet 4.6,升級了什麼
Agent 完成度、成本—效能區間,以及工具協作——當作 Sonnet 主力前最該看清的變化。
Agent 能力大幅躍升
推理、工具使用、編程與知識工作相對 4.6 全面抬升;在合適深度檔位下,部分任務可接近 Opus 4.8 的完成水平。
Anthropic 隨 Claude Sonnet 5 一併公佈的評測結果,與 Claude Sonnet 4.6、Claude Opus 4.8 同屏對照,覆蓋軟體工程、多學科推理、電腦使用與安全審計。
多工總覽。SWE-bench Pro 63.2%、Terminal-Bench 2.1 80.4%,均明顯高於 Claude Sonnet 4.6(58.1% / 67.0%);GDPval-AA v2 得分 1618,與 Claude Opus 4.8 的 1615 基本持平——這是判斷 Sonnet 5 能否以中檔成本承擔原先 Opus 級工作的關鍵一行。
行為對齊審計統計欺騙、被誘使濫用等不對齊行為,分數越低越好。Claude Sonnet 5 為 2.53,低於 Claude Sonnet 4.6 的 2.89;把它放進自動化流程之前,這一項與能力分數同樣值得看。