Claude Sonnet 5 发布
Introducing Claude Sonnet 5
Anthropic 发布 Claude Sonnet 5,定位为最具 agent 能力的 Sonnet 模型,支持规划、浏览器和终端工具使用。其 agentic 性能接近 Opus 4.8,在推理、工具使用、编码和知识工作方面较 Sonnet 4.6 显著提升。安全评估显示其不良行为发生率低于 Sonnet 4.6,网络安全任务能力远低于 Opus 模型。即日起在所有计划中可用,推出价格为每百万输入 token 2 美元、输出 token 10 美元,有效期至 2026 年 8 月 31 日。
Claude Sonnet 5 被打造为迄今为止最具 agent 能力的 Sonnet 模型。它可以制定计划、使用浏览器和终端等工具,并以几个月前还需要更大、更昂贵模型才能达到的水平自主运行。
对许多开发者而言,agentic AI 时代始于 Sonnet 级别的模型:Claude Sonnet 3.5、3.6 和 3.7 是首批在编码和工具使用方面展现出令人印象深刻技能的模型。不过,最近 agentic 能力最明显的提升出现在我们的 Opus 级别模型中。
Sonnet 5 缩小了这一差距:其性能接近 Opus 4.8,但价格更低。与上一代 Sonnet 4.6 相比,它在 agentic 性能的重要方面(如推理、工具使用、编码和知识工作)有了显著提升:

Sonnet 5 在多项评估中的得分与 Sonnet 4.6 和 Opus 4.8(作为参考的通用能力更强的模型)的对比。Claude Sonnet 5 System Card 详细报告了更广泛的评估结果。
我们的安全评估发现,Sonnet 5 的不良行为发生率总体上低于 Sonnet 4.6,并且在 agentic 场景中使用通常更安全。评估还显示,它执行网络安全任务的能力远低于我们当前的 Opus 模型。
从今天起,Claude Sonnet 5 在所有计划中均可使用:它是 Free 和 Pro 计划的默认模型,并可供 Max、Team 和 Enterprise 用户使用。它也可在 Claude Code 和 Claude Platform 上使用,在 Platform 上,其推出价格为每百万输入 token 2 美元,每百万输出 token 10 美元,有效期至 2026 年 8 月 31 日,之后定价将为每百万输入 token 3 美元,每百万输出 token 15 美元。开发者可以通过 Claude API 使用 claude-sonnet-5。
使用 Claude Sonnet 5
下图比较了 Sonnet 5、Sonnet 4.6 和 Opus 4.8 在 agentic 搜索评估 BrowseComp 和计算机使用评估 OSWorld-Verified 中,在不同 effort 级别下的性能。Sonnet 5(橙色线)相比 Sonnet 4.6(灰色线)有严格改进。Opus 4.8(黄色线)在这些任务上仍然是追求更高准确度的首选模型,但 Sonnet 5 为开发者提供了价格更低、质量远高于以往的选择。在 Sonnet 5 和 Opus 4.8 之间,用户可以通过调整 effort 级别来找到成本与性能之间的最佳平衡点。
我们早期访问合作伙伴的反馈是一致的:Sonnet 5 比其前代模型更具 agent 能力。测试人员描述了它如何完成以前 Sonnet 模型会中途停止的复杂任务,如何在没有明确要求的情况下检查自己的输出,以及如何以有吸引力的价格完成所有这些 agentic 工作:
Claude Sonnet 5 为我们的 agent 提供了强大的执行层,用于处理多步骤软件工程工作。它在混乱的技术上下文中很好地处理了持续的编码、工具使用和调试,并且在需要跟进和技术基础的流程中特别有用。
我们交给 Claude Sonnet 5 一个两部分的任务——更新 Salesforce 账户层级,向企业联系人发送发布公告——它从头到尾完成了。这以前会在中途停滞。对于日常自动化来说,这是轻而易举的事。
Claude Sonnet 5 用更少的资源完成更多工作。相同的输出质量,更少的步骤。它也能干净、一致地拒绝不安全的请求。在 Lovable,我们正在将强大的工具交到数百万构建者手中。一个知道何时说不的模型,与一个知道如何构建的模型同样重要。
我们用几十个最具挑战性的真实 pull request 测试了 Claude Sonnet 5,它独立地将每一个都推进到经过测试和验证的结果——让我们的工程师能够专注于判断、决策和最终签署。
我让 Claude Sonnet 5 调查一个 bug。在没有提示的情况下,它编写了一个复现测试,实现了修复,然后将其暂存以确认没有这个更改 bug 会再次出现。全部一次性完成。
使用 Claude Sonnet 5,agent 能坚持计划,遵循我们的约定,并交付干净的多步骤更改,而且成本高效。
Claude Sonnet 5 在遗留代码上表现最佳——竞态条件、隐藏测试、没人想碰的部分。它能将失败追溯到实际根本原因,并交付持久的修复,而不是修补症状。
Claude Sonnet 5 处于 Eve 原告律师任务的帕累托前沿。我们在法律研究和分析方面看到了最明显的收益,其性价比使得迁移的选择变得容易。
ClickHouse agent 实时探索实时数据并即时产生洞察,因此在测试新模型时,获取洞察的时间很重要。Claude Sonnet 5 以更紧凑的步骤进行推理,让我们的用户明显更快地得到答案。这种速度是我们的客户能感受到的差异。
在 Pace,我们的计算机使用 agent 在我们运营团队已经使用的系统上运行保险工作流——提交受理、FNOL、损失运行。Claude Sonnet 5 始终如一地采取正确行动并快速完成,这正是真正的保险工作所需要的。
01 /
10
安全评估
我们的部署前安全评估发现,Sonnet 5 总体上比 Sonnet 4.6 有所改进。在 agentic 安全方面,该模型在拒绝恶意请求和抵抗 prompt injection 攻击中的劫持尝试方面表现更好。该模型显示出比 Sonnet 4.6 更低的幻觉和谄媚率。在我们的自动化行为审计中(该审计测试了广泛的不对齐行为,例如与滥用和欺骗的合作),Sonnet 5 总体得分更低(即更安全)。然而,与能力更强的 Opus 4.8 和 Claude Mythos Preview 相比,它在此评估中确实显示出略高的不对齐行为发生率。

在我们的自动化行为审计中,不对齐行为的发生率,该审计测试了多种情境和上下文中的非常广泛的不良行为(完整列表和每个具体行为的结果见 Sonnet 5 System Card 第 6.4 节)。Sonnet 5 的不对齐行为总体发生率低于 Sonnet 4.6,但高于 Mythos Preview 和 Opus 4.8。
我们没有刻意训练 Sonnet 5 执行网络安全任务。它可以执行一些常规的、无害的网络任务,但在测试潜在危险网络技能(例如开发软件漏洞利用)的评估中,其表现明显差于 Opus 4.8 和 Mythos 5 等模型。下图显示了一项评估的得分,该评估测试了模型为 Firefox 浏览器中的漏洞开发漏洞利用的能力。Sonnet 5 从未能够开发出完整可用的漏洞利用,但它确实显示出比 Sonnet 4.6 略高的_部分_成功率。后者的变化很可能是由于通用智能的提升,而非特定训练。

衡量模型为 Firefox 147 中的软件漏洞开发漏洞利用成功率的得分(此评估是与 Mozilla 合作开发的;所有漏洞已在 Firefox 148 中修补)。对于每个模型,左侧柱状图显示模型(无防护措施)开发出可用漏洞利用的频率;右侧柱状图显示模型部分成功的频率。两个 Sonnet 模型都无法成功开发出可用的漏洞利用(均得分为 0.0%);Sonnet 5 的部分成功率略高于 Sonnet 4.6。两个 Sonnet 模型的网络能力都明显低于 Opus 4.8 和 Mythos 5。完整详情见 Sonnet 5 System Card 第 3.2.4 节。
由于 Sonnet 5 在这些任务上比其前代稍强,我们已默认启用网络安全防护措施启动它。这些防护措施——能够实时检测并阻止危险的网络使用——与 Claude Opus 4.7 和 4.8 中的相同(因为我们判断 Sonnet 5 的整体网络安全风险水平较低,所以防护措施不如 Fable 5 启动时那么严格,后者阻止了更广泛的网络安全任务)。1
我们在 Claude Sonnet 5 System Card 中报告了我们对 Sonnet 5 在多项安全和能力评估中的完整评估。
可用性与定价
Claude Sonnet 5 今天已在所有平台上线,推出价格为每百万输入 token 2 美元,每百万输出 token 10 美元,有效期至 2026 年 8 月 31 日。之后将转为标准定价,每百万输入 token 3 美元,每百万输出 token 15 美元。2 我们提高了 Chat、Cowork、Claude Code 和 Claude Platform 3 的速率限制,以适应更高 effort 级别带来的更高 token 使用量;用户可以选择适合其特定项目的任何级别。
脚注
1 Sonnet 5 是我们的网络验证计划的一部分,该计划今天已在原生 Claude Platform、AWS 上的 Claude Platform 以及 Microsoft Foundry 中的 Claude(托管在 Azure 和 Anthropic 上)可用,即将在 Google Vertex 中的 Claude 上推出。已加入网络验证计划的组织在 Sonnet 5 上自动拥有相同的访问权限,无需重新申请。总体而言,对于需要减少护栏的网络安全工作,我们推荐使用 Claude Opus 4.8。
2 Sonnet 5 是 Sonnet 4.6 的升级版,但它使用了更新的 tokenizer,改变了模型处理文本的方式以提升性能(这与我们在 Claude Opus 4.7 中引入的 tokenizer 更改类似)。其权衡是相同的输入可能会映射到更多的 token:大约 1.0–1.35 倍,具体取决于内容类型。推出定价的设置使得过渡到 Sonnet 5 大致成本中性。
3 2026 年 4 月 26 日,我们提高了每个使用层级的 Sonnet 和 Haiku 速率限制,并在原生 Claude Platform 上简化为三个层级(Start、Build 和 Scale)。您可以在 Claude Console 查看您的层级和当前限制,或阅读文档了解更多。
- Humanity's Last Exam: 我们更新了 Humanity's Last Exam 的评分模型,并将 Sonnet 4.6 的得分更新为 34.6%(无工具)和 46.8%(有工具)。这是该得分与 Sonnet 4.6 发布博客中报告的不同之处。
- OSWorld-Verified: 我们更改了运行 OSWorld-Verified 评估的方式,以更准确地反映模型在现实世界中的性能,并将 Sonnet 4.6 的得分更新为 78.5%。这是该得分与 Sonnet 4.6 发布博客中报告的不同之处。
相关内容
Claude Science,面向科学家的 AI 工作台,现已可用
Claude Science 是一个可定制的应用程序,集成了研究人员最常使用的工具和包,生成可审计的工件,并提供对计算资源的灵活访问。
介绍 Claude Tag
Claude Tag 是团队与 Claude 协作的一种新方式。