Anthropic 发布了专为智能体(agent)用途打造的新语言模型「Claude Sonnet 5」[1]。它在制定计划、使用浏览器和终端等工具、以及自主推进任务方面的能力大幅提升,能以更实惠的价格完成不久前还需要更大、更昂贵模型才能胜任的工作[1]。本文梳理其性能、价格以及安全评估的要点。
逼近 Opus 4.8,超越 Sonnet 4.6
Anthropic 表示,智能体型 AI(自主判断并推进工作的 AI)的浪潮正是从「Sonnet 级」模型开始的[1]。Claude Sonnet 3.5、3.6、3.7 是最早在编程和工具操作上展现出强大实力的一批模型[1]。不过,近来能力提升的主力一直集中在更高端的「Opus 级」[1]。
此次的 Sonnet 5 意在缩小这一差距[1]。其性能逼近高端的 Claude Opus 4.8,价格却得到了控制[1]。与上一代 Sonnet 4.6 相比,它在推理、工具操作、编程、知识工作等智能体性能的关键环节上都有稳步改进[1]。
Anthropic 通过衡量智能体检索的「BrowseComp」和衡量计算机操作的「OSWorld-Verified」两项评测进行了比较[1]。在这些指标上,Sonnet 5 明显优于 Sonnet 4.6;在需要最高精度的场景中,Opus 4.8 仍是更合适的选择,但 Sonnet 5 以更低价格提供了比以往更高质量的选项[1]。在 Sonnet 5 与 Opus 4.8 之间,用户可调整「effort(投入处理的程度)」,以找到成本与性能的最佳平衡[1]。
早期合作伙伴的评价
Anthropic 还介绍了在发布前进行试用的合作企业的反馈[1]。共同之处在于其自主性:「能把以往 Sonnet 会中途停下的复杂任务做到底」「不用特意要求也会检查自己的输出」[1]。
例如,开发服务商 Lovable 称赞它能够清晰且一致地拒绝不安全的请求[1]。法律领域的 Eve 表示,它在原告方法律任务上性价比很高,迁移决定因此变得容易;数据分析平台 ClickHouse 则报告称,它能以更紧凑的步骤更快得出答案[1]。在保险业务中使用计算机操作智能体的 Pace 也提到,它能稳定且迅速地选择正确的操作[1]。
安全评估结果
Anthropic 公开了部署前安全评估的结果[1]。总体而言,Sonnet 5 相比 Sonnet 4.6 有所改进,对恶意请求的拒绝以及对提示注入(试图劫持模型指令的攻击)的抵抗力都有所增强[1]。陈述不实内容的幻觉,以及过度迎合用户的谄媚倾向,比例也都有所下降[1]。
另一方面,与更强的 Opus 4.8 等相比,它在部分不当行为上的比例略高[1]。在网络安全方面,Anthropic 说明 Sonnet 5 并未刻意训练,在利用软件漏洞等危险任务上的能力远逊于高端模型[1]。不过,由于其能力较上一代略有提升,因此在提供时默认开启了能实时检测并阻断危险使用的网络安全防护[1]。详细的评估结果汇总在「Claude Sonnet 5 System Card」中[1]。
提供范围与价格
Claude Sonnet 5 自发布当天起即可在所有套餐中使用[1]。它成为免费套餐和 Pro 套餐的默认模型,Max、Team、Enterprise 各类用户也都可使用[1]。它可在 Claude Code 和 Claude Platform 上使用,通过 API 可以「claude-sonnet-5」调用[1]。
作为开业纪念价,截至 2026 年 8 月 31 日,每百万输入 token 为 2 美元(约 320 日元),每百万输出 token 为 10 美元(约 1,620 日元)[1]。该期间结束后将转为标准价格,输入 3 美元(约 490 日元)、输出 15 美元(约 2,430 日元)[1]。※1 美元 = 162 日元(截至 2026 年 7 月 1 日)
此外,Sonnet 5 采用了新的分词器(tokenizer,将文本切分为 token 的机制),因此相同的输入可能会映射为以往 1.0~1.35 倍的 token 数[1]。开业价的设定是为了即便考虑到这一变化,迁移的成本也大致保持不变[1]。同时,Chat、Cowork、Claude Code、Claude Platform 各项服务的速率限制(单位时间内的使用上限)也都有所提高[1]。
总结
Claude Sonnet 5 是一款重视智能体用途的模型,旨在以更低价格提供逼近高端 Opus 4.8 的性能。除了在推理、编程、工具操作上的改进外,它在安全评估中也较上一代有所进步;不过,开业期结束后价格会上涨,以及分词器变更带来的实际成本感,都是使用前值得确认的地方。
