Anthropic 于 2026 年 9 月 22 日发布了最新大语言模型 Claude Opus 5.5。作为 7 月推出的 Opus 5 的继任者,新模型将使用价格最多下调 40%,同时响应速度提升超过 30%。在以编程和知识工作为主的多项基准测试中,Opus 5.5 的表现均超过了前代模型。

大幅下调价格体系

Opus 5.5 的输入令牌价格降至每百万令牌 4 美元,较 Opus 5 的 5 美元下降 20%。输出令牌价格降至每百万令牌 20 美元,同样较 25 美元下降 20%。缓存读取价格降幅更大,从每百万令牌 0.5 美元降至 0.2 美元,降幅达 60%。Anthropic 表示,在贴近实际使用场景的典型工作负载下,整体成本平均可下降约 40%。

※1 美元 = 155 日元(参考 2026 年 9 月中旬市场汇率)

价格下调的主要原因在于计算资源利用效率的提升。Anthropic 表示,能够以更低的计算成本实现相同性能,是本次价格调整的直接原因。

编程与知识工作性能提升

在基准测试方面,Opus 5.5 在评估软件开发能力的 Terminal-Bench 4.0 中取得了 66.4% 的成绩,在衡量编程能力的 FrontierCode v1.1 中也达到了 54.4%。据介绍,该模型曾在不到一天的时间内完成了一项涉及 68 万行代码的迁移任务。

在知识工作评估方面,Opus 5.5 在覆盖 44 种职业的实务评估 GDPval-AA v2.1 中获得了 1,846 分的 Elo 评分。Anthropic 表示,这是该公司迄今测得的最高性能水平。Anthropic 还表示,Opus 5.5 在大多数工作中的表现已达到该公司更大规模模型 Claude Fable 5.1 的水平,尤其在自主编程、计算机操作和知识工作方面表现突出。

响应速度与安全性同步增强

处理速度较 Opus 5 提升超过 30%。同时,Anthropic 还对模型的表达方式进行了调整,包括将关键信息前置、减少不必要的专业术语等,以提升回答的易读性。

在安全性方面,Opus 5.5 在自动化行为审计中取得了 Anthropic 迄今测得的最高评价,对提示注入攻击的抵御能力也有所增强。随着模型性能不断提升,Anthropic 似乎正同步推进安全性方面的工作。

提供范围与后续产品线

Claude Opus 5.5 已于发布当日起,通过 Claude Platform 以及 Amazon Web Services、Google Cloud、Microsoft Azure 等主流云平台提供服务。各订阅方案的使用额度也有所提升。

Anthropic 表示,中端模型 Claude Sonnet 5.5 与轻量级模型 Claude Haiku 5.5 将在未来数周内完成同等程度的改进后发布,Opus、Sonnet、Haiku 三档产品体系将维持不变。

总结

Claude Opus 5.5 在将价格最多下调 40% 的同时,提升了编程与知识工作相关基准测试的成绩,响应速度也提高了超过 30%,安全性评估同样有所加强。Anthropic 计划在未来数周内推出 Sonnet 5.5 与 Haiku 5.5。在 AI 开发竞争持续之际,这次发布在性能与成本两方面都展现出了存在感。

参考来源: [1] https://www.anthropic.com/claude-opus-5-5