Anthropicは、エージェント用途に特化した新しい言語モデル「Claude Sonnet 5」を発表しました[1]。計画を立て、ブラウザやターミナルといったツールを使い、自律的にタスクを進める能力が大きく高まっており、少し前なら上位の大型モデルでしか実現できなかった水準の処理を、より手頃な価格でこなせるとしています[1]。本記事では、性能と価格、そして安全性評価のポイントを整理します。

Opus 4.8に迫り、Sonnet 4.6を上回る

Anthropicによると、エージェント型AI(自律的に判断し作業を進めるAI)の流れは「Sonnetクラス」のモデルから本格的に始まったといいます[1]。Claude Sonnet 3.5・3.6・3.7は、コーディングやツール操作で高い実力を見せた最初のモデル群でした[1]。一方で、ここ最近の能力向上は上位の「Opusクラス」が中心になっていました[1]。

今回のSonnet 5は、その差を縮める位置づけです[1]。性能は上位モデルのClaude Opus 4.8に近づきつつ、価格は抑えられています[1]。前世代のSonnet 4.6と比べても、推論・ツール操作・コーディング・知識労働といったエージェント性能の要点で着実に改善したとしています[1]。

Anthropicは、エージェント検索を測る「BrowseComp」と、コンピュータ操作を測る「OSWorld-Verified」という評価で比較を示しています[1]。これらの指標でSonnet 5はSonnet 4.6を明確に上回り、最高精度が必要な場面では引き続きOpus 4.8が適するものの、Sonnet 5は従来より高品質な選択肢を低価格で提供するとしています[1]。Sonnet 5とOpus 4.8の間では、ユーザーが「effort(処理の手間をかける度合い)」を調整して、コストと性能の最適なバランスを探せます[1]。

早期利用パートナーの評価

Anthropicは、提供に先立って試したパートナー企業からの感想も紹介しています[1]。共通していたのは「以前のSonnetなら途中で止まっていた複雑なタスクを最後までやり切る」「頼まなくても自分の出力を確認する」という、自律性に関する評価でした[1]。

たとえば開発支援サービスのLovableは、安全でない要求をはっきりと一貫して断る点を評価しています[1]。法務分野のEveは、原告側の法務タスクで費用対効果が高く移行を決めやすかったと述べ、データ分析基盤のClickHouseは、より短い手順で素早く答えにたどり着くと報告しています[1]。保険業務でコンピュータ操作エージェントを使うPaceも、正しい操作を素早く選ぶ点を挙げています[1]。

安全性評価の結果

Anthropicは導入前の安全性評価の結果も公開しています[1]。全体としてSonnet 5はSonnet 4.6より改善し、悪意ある要求の拒否やプロンプトインジェクション(指示の乗っ取りを狙う攻撃)への耐性が高まったとしています[1]。事実に反する内容を述べるハルシネーションや、相手に過度に同調するシカファンシーの割合も低下しました[1]。

一方で、より高性能なOpus 4.8などと比べると、一部の不適切な挙動の割合がやや高い結果も出たとしています[1]。サイバーセキュリティ関連では、Sonnet 5は意図的に訓練しておらず、ソフトウェアの脆弱性を突くような危険なタスクの能力は上位モデルより大きく劣ると説明しています[1]。ただし前世代よりわずかに能力が上がっているため、危険な利用を検知して遮断するサイバー防護機能を既定で有効にした状態で提供されます[1]。詳細な評価結果は「Claude Sonnet 5 System Card」にまとめられています[1]。

提供範囲と価格

Claude Sonnet 5は発表と同日からすべてのプランで利用できます[1]。無料プランとProプランの既定モデルとなり、Max・Team・Enterpriseの各ユーザーも利用できます[1]。Claude CodeやClaude Platformでも使え、API経由では「claude-sonnet-5」として呼び出せます[1]。

価格は導入記念として、2026年8月31日まで入力100万トークンあたり2ドル(約320円)、出力100万トークンあたり10ドル(約1,620円)に設定されています[1]。期間終了後は入力3ドル(約490円)、出力15ドル(約2,430円)の標準価格に移行します[1]。※1ドル=162円換算(2026年7月1日時点)

なお、Sonnet 5は新しいトークナイザー(文章をトークンに分割する仕組み)を採用しており、同じ入力でもトークン数が従来の1.0〜1.35倍に増える場合があります[1]。導入価格は、この変化を踏まえても移行のコストがおおむね変わらないように設定されているとのことです[1]。あわせて、Chat・Cowork・Claude Code・Claude Platformの各サービスでレート制限(一定時間あたりの利用上限)も引き上げられました[1]。

まとめ

Claude Sonnet 5は、上位モデルのOpus 4.8に迫る性能を低価格で提供することを狙った、エージェント用途重視のモデルです。推論やコーディング、ツール操作の改善に加え、安全性評価でも前世代から進歩した一方、価格は導入期間後に上がる点やトークナイザー変更による実質的なコスト感は、利用前に確認しておきたいところです。

出典:https://www.anthropic.com/news/claude-sonnet-5