Anthropicが8月21日、サイバーセキュリティ性能では世界最高水準とする自社モデル「Claude Mythos 5」を、コード診断サービス「Claude Security」から使えるようにしました。対象はClaude Enterprise契約の組織で、現時点ではパブリックベータの扱いです。モデルと自由に会話させるのではなく、脆弱性の指摘と修正案だけを受け取る形に絞ったのが今回の要点になります。

プロンプト画面を渡さない、という割り切り

Mythosは、Anthropicのモデル群のなかでも一般提供されてこなかった系列です。同社は4月に「Project Glasswing」を立ち上げ、重要インフラのソフトウェアを守る一部の組織に限ってMythos Previewとその後継であるMythos 5を渡してきました。攻撃側が同等の能力を手にする前に、守る側へ先に時間を与えるという発想です。

裏を返せば、それだけ扱いが難しいモデルということでもあります。脆弱性を見つけ出す能力は、そのまま攻撃コードを書く能力でもあるからです。同じ基盤のモデルを広く提供している「Claude Fable 5」では、サイバーや生物・化学といった転用リスクのある問い合わせを分類器で振り分け、Mythos側へは通さない設計が取られていました。

今回Anthropicが示したのは、能力そのものを絞るのではなく、利用者との接点を作り変えるという解き方です。危険が集中するのは利用者がモデルに直接指示を出せる場面であり、受け取れるものが修正パッチやアラートといった決まった成果物だけであれば、リスクはかなり下がる。この整理に沿って、成果物へのアクセスを広げつつ、モデル本体への直接アクセスには引き続き制限をかけています。

GitHubのリポジトリを選ぶだけで診断が走る

使い方はシンプルです。Enterpriseの管理者が管理コンソールでClaude Securityを有効にすると、利用者は診断画面からリポジトリを選べるようになります。あとはMythos 5がコードベースを走査し、見つかった問題を1件ずつ返してきます。

報告に付くのは、CWE(共通脆弱性タイプ一覧)の分類、深刻度と確信度の評価、そして修正案です。単純なパターン照合ではなく、ファイルをまたいだデータの流れを追う点が特徴で、Anthropicはメモリ破壊やインジェクション、認証回避、複数ファイルにまたがるロジックの誤りといった深刻度の高い問題を主な対象に挙げています。

追加料金はなし、適用の判断は人が握る

課金は既存プランの通常のトークン利用として処理され、Mythos 5を使うための追加オプションは必要ありません。Enterprise契約を持っていれば、そのまま最上位の診断能力に手が届く形です。

一方で、見つかった問題の修正は別の場所で行います。利用者はWeb版のClaude Codeを開いてパッチを当てますが、この作業に使われるのは組織がもともと契約しているモデルです。診断でMythos 5を通したからといって、他の画面でMythos 5が使えるようになるわけではありません。そして、どのパッチも人間のレビューと承認を経なければ適用できません。AIに任せきりにさせない線引きが、はっきり引かれています。

オープンソースの防御に3,500万ドルの枠

同じ発表のなかで、Anthropicは「Defender Advantage Fund(0xDAF)」も立ち上げました。オープンソースのソフトウェアを守る組織に対し、3,500万ドル(約56億円)分のClaudeクレジットを提供する枠組みです。

※1ドル159円換算

配分先として想定しているのは3つの領域です。広く使われているプロジェクトで現に残っている脆弱性を潰すこと、走査と修正の流れを自動化して他のプロジェクトが真似できる形にすること、そして攻撃手法のまとまりごと無効化するような、より踏み込んだ設計に挑戦することです。まずは少数の大型パイロット助成から始め、対象組織は数週間のうちに公表するとしています。

Project Glasswingでも、Anthropicはオープンソースのセキュリティ団体へ400万ドル(約6億4,000万円)の寄付を行い、脆弱性修正を横断的に進める取り組みを支えてきました。今回の枠はその延長線上にあります。世界中で動いている基幹的なソフトウェアの多くが、ボランティアや非営利団体の手で維持されているという現実に、資金と計算資源の両面から手を入れる形です。

パートナー製品への組み込みと、検証プログラムの拡大

Anthropicはさらに2つの動きを予告しています。1つは、セキュリティ製品を手掛けるパートナー各社の製品やサービスにMythos 5を組み込む取り組みです。病院や電力・水道、金融システム、ソフトウェアのサプライチェーンを守る現場はすでに専用のツール群を回しており、そこへ後ろから差し込むほうが早いという判断でしょう。この場合も利用者が触れるのは製品の画面であり、モデルに直接指示を出す経路は用意されません。

もう1つは「Cyber Verification Program」の拡大です。審査を通った防御側の組織に対して、OpusやSonnetでの制限を緩める仕組みですが、今後数週間かけて対象となる能力の範囲を広げ、その先でMythos系へのアクセスにも手を伸ばすとしています。米国政府と組んだProject Glasswingについても、厳格なセキュリティ要件を満たす重要インフラの担い手へ引き続き広げていく方針です。

まとめ

今回の発表は、新しいモデルが出たという話ではありません。すでに存在していた最上位の能力を、どういう窓口で渡せば安全に配れるのかという設計の話です。プロンプト画面を渡さず、決まった成果物だけを返す。この割り切りが機能すれば、フロンティアモデルの提供範囲は「誰に渡すか」だけでなく「どう渡すか」で決まるようになっていきます。Enterprise契約を持つ組織にとっては、追加費用なしで試せる選択肢が1つ増えた形です。