Anthropic 於 2026 年 9 月 22 日發表了最新大型語言模型 Claude Opus 5.5。作為 7 月推出的 Opus 5 後繼機種,新模型將使用價格最多調降 40%,回應速度則提升超過 30%。在以程式撰寫與知識型工作為主的多項基準測試中,Opus 5.5 的表現均優於前一代模型。
大幅調降價格結構
Opus 5.5 的輸入權杖(token)價格降至每百萬權杖 4 美元,較 Opus 5 的 5 美元調降 20%。輸出權杖價格則降至每百萬權杖 20 美元,同樣較 25 美元調降 20%。快取讀取價格降幅更大,從每百萬權杖 0.5 美元降至 0.2 美元,降幅達 60%。Anthropic 表示,在貼近實際使用情境的一般工作負載下,整體成本平均可望下降約 40%。
※1 美元 = 155 日圓(參考 2026 年 9 月中旬市場匯率)
價格調降的主要原因在於運算資源使用效率的提升。Anthropic 指出,能以更低的運算成本達成相同效能,是這次調整價格的直接原因。
程式撰寫與知識工作效能提升
在基準測試方面,Opus 5.5 在評估軟體開發能力的 Terminal-Bench 4.0 中取得 66.4% 的成績,在衡量程式撰寫能力的 FrontierCode v1.1 中則達到 54.4%。據介紹,該模型曾在不到一天的時間內完成一項涉及 68 萬行程式碼的移轉作業。
在知識工作評估方面,Opus 5.5 在涵蓋 44 種職業的實務評估 GDPval-AA v2.1 中獲得 1,846 分的 Elo 評分。Anthropic 表示,這是該公司目前測得的最高效能水準。Anthropic 也表示,Opus 5.5 在多數工作上的表現已達到該公司更大規模模型 Claude Fable 5.1 的水準,尤其在自主程式撰寫、電腦操作與知識工作方面表現突出。
回應速度與安全性同步強化
處理速度較 Opus 5 提升超過 30%。同時,Anthropic 也調整了模型的表達方式,包括將重要資訊置於回應前段、減少不必要的專業術語等,以提升回答的易讀性。
在安全性方面,Opus 5.5 在自動化行為稽核中取得 Anthropic 目前測得的最高評價,對提示注入攻擊的抵禦能力也有所提升。隨著模型效能持續進化,Anthropic 似乎也同步推進安全性方面的強化工作。
提供範圍與後續產品線
Claude Opus 5.5 自發表當日起,已透過 Claude Platform 以及 Amazon Web Services、Google Cloud、Microsoft Azure 等主要雲端平台提供服務。各方案的使用額度也隨之提高。
Anthropic 表示,中階模型 Claude Sonnet 5.5 與輕量級模型 Claude Haiku 5.5 將於未來數週內完成同等程度的改良後推出,Opus、Sonnet、Haiku 三階產品陣容將維持不變。
總結
Claude Opus 5.5 在將價格最多調降 40% 的同時,提升了程式撰寫與知識工作相關基準測試的成績,回應速度也提升超過 30%,安全性評估同樣獲得強化。Anthropic 計劃於未來數週內推出 Sonnet 5.5 與 Haiku 5.5。在 AI 開發競爭持續之際,這次發表在效能與成本兩方面都展現出相當的存在感。
