Anthropicは2026年7月24日(米国時間)、対話AI「Claude」の新モデル「Claude Opus 5」を公開しました[1]。最上位モデル「Claude Fable 5」に迫る知能を、その半分のコストで実現したとうたうモデルで、コーディングや知識労働の評価では新たな最高水準に達したとしています。個人向けの「Claude Max」では新しい標準モデルとなり、公開当日からすべてのプラットフォームで利用できます[1]。

Fable 5に迫る知能を、より低いコストで

Claude Opus 5の位置づけは「毎日使える高性能モデル」です。Anthropicによれば、前世代の「Opus 4.8」と同じ価格ながら性能を大きく引き上げ、思考にかける労力(effort)の設定を通じて、知能を優先するか、トークンを節約して高速・低コストに寄せるかを使い分けられます[1]。

コーディングや知識労働を測る「Frontier-Bench」や「GDPval-AA」といった評価では、Opus 5が新たな最高水準に立ったとしています。ただしサイバーセキュリティ系のタスクでは、同社の別モデル「Mythos 5」に及ばないと明記しています[1]。得意な領域とそうでない領域を切り分けて示している点が特徴です。

主要ベンチマークで軒並み上位に

具体的な数値も公開されています[1]。ソフトウェア開発を評価する「Frontier-Bench v0.1」では、Opus 4.8の性能を2倍以上に伸ばしつつ、1タスクあたりのコストはむしろ下げたとしています。コード編集の「CursorBench 3.2」では、最大effort時にFable 5のピーク性能との差が0.5%以内に収まり、しかも1タスクあたりのコストは半分だといいます。

新しい問題を解く力を測る「ARC-AGI 3」では、次点のモデルの3倍のスコアを記録しました。業務を最初から最後までやり切れるかを見る「Zapier AutomationBench」でも、同じコストで次点の約1.5倍の成功率となり、最も低いeffort設定でも他のどのモデルより多くのタスクをこなしたとしています。コンピュータ操作を測る「OSWorld 2.0」では、あらゆるコスト帯で他モデルを上回り、Fable 5の最高結果をおよそ3分の1のコストで超えたとしています[1]。

自分で検証しながら仕事を進める

Anthropicは、Opus 5が自分の作業を検証し、うまくいくまで粘り強く改善する力に優れると説明します[1]。ある評価では、機械部品の図面を渡してコードで3Dモデルを再現させる課題で、図面を直接「見る」手段を与えられなかったにもかかわらず、Opus 5は自前で画像認識の処理を書き、生の画素から形状を読み取って部品を作り上げたといいます。ほかにも、広く使われるパッケージ管理ツールの不具合で、コミュニティの修正が見落としていた根本原因を突き止めた例などが挙げられています[1]。

科学研究の分野でも進歩がみられます。生命科学の各評価でOpus 4.8を上回り、分光データから分子構造を推定する有機化学の課題では社内基準で10.2ポイント、タンパク質関連の課題では7.7ポイント高いスコアだったとしています[1]。

安全性は「最も整合的」、サイバー能力は意図的に抑制

安全性の評価も公開されました。Anthropicは、配備前のテストでOpus 5を「これまでで最も整合的(アライメントが取れた)モデル」と位置づけ、行動指針である「Constitution」への準拠度がOpus 4.8やSonnet 5、Fable 5より高く、欺くような振る舞いや悪用の誘導に対する耐性も最も強かったとしています[1]。

一方で、危険につながりうる能力は意図的に抑えられています。生物学研究や攻撃的なサイバー能力ではMythos 5に及ばず、サイバー系のタスクは学習段階で意図的に避けたと説明しています。脆弱性を「見つける」力はMythos 5に近づいたものの、それを実際の脅威に変える「悪用」の力では大きく離されているとしています[1]。安全装置となる分類器はFable 5よりも約85%少ない頻度でしか介入しない見込みで、ソースコードの脆弱性調査は認めつつ、侵入テストや攻撃コードの生成はブロックする設計です[1]。

提供形態と価格

Claude Opus 5は公開当日からすべてのプラットフォームで使えます。価格は100万トークンあたり入力が5ドル(約820円)、出力が25ドル(約4,100円)で、Opus 4.8から据え置きです[1]。開発者はClaude APIで「claude-opus-5」として利用でき、約2.5倍の速さで動く「Fast mode」も基本価格の2倍で提供されます[1]。

※1ドル164円換算(2026年7月24日時点)

あわせて2つのベータ機能も追加されました。Claude Platformでは会話の途中で使えるツールを切り替えてもプロンプトのキャッシュが無効にならないようになり、APIでは安全分類器に引っかかったリクエストを自動的に別モデルへ振り替える「自動フォールバック」が使えるようになりました[1]。

まとめ

Claude Opus 5は、最上位のFable 5に迫る知能を半額で使えることを前面に打ち出した新モデルです。多くのベンチマークで最高水準を示す一方、サイバー攻撃や高度な生物学研究といった危険につながる能力はMythos 5より低く抑え、整合性の高さを強調しました。価格をOpus 4.8から据え置きつつ性能を底上げした点も含め、日常的に使う主力モデルとしての完成度を高めた一手と言えそうです。

出典:https://www.anthropic.com/news/claude-opus-5