IMAGE: AI生成ビジュアル
GOVERNANCE / Governance
Anthropic、Claude Mythos 5の防御能力を開放拡大 — Claude SecurityがEnterpriseでMythos 5対応、オープンソース向け3500万ドル基金も
直接のモデル対話ではなく「成果物だけ」を受け取る設計で防御側への提供を拡大。Claude SecurityのスキャンはMythos 5で実行、パートナー製品への組み込みやCyber Verification Programの拡張、Defender Advantage Fund(0xDAF)による3500万ドルのClaudeクレジット提供を発表した。
Anthropicは2026年8月21日、公式ブログ「Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders」を公開し、フロンティアモデルClaude Mythos 5のサイバー防御能力をより多くの防御側へ安全に届けるための4つの施策を示した。4月に開始したProject GlasswingでMythos Previewとその後継のMythos 5を重要インフラ等の限られた組織に先行提供してきた経緯を踏まえ、直接のモデル対話ではなく防御成果物だけを提供する設計でアクセスを拡大する方針だ。
何が変わるか — 4つの施策
発表で示された取り組みは以下の通り。いずれも「ユーザーが直接Mythos 5をプロンプトできる状態」と「防御成果物だけを受け取る状態」のリスク差を前提に、防御成果へのアクセスを広げつつ悪用リスクを抑える設計が強調されている。
- Claude SecurityのスキャンがMythos 5で実行可能に: Claude Enterpriseプラン向けにpublic beta提供中のClaude Securityで、コードベースの脆弱性スキャンをMythos 5で実行できるようになった。管理コンソールで有効化し、
claude.ai/securityからリポジトリを選択してスキャンする。検出結果はCWE(Common Weakness Enumeration)カテゴリ、confidence/severity評価、修正案付きで返却される。スキャン自体は既存プランの標準トークン課金で、別途アドオン費用は発生しないとしている。検出後のインタラクティブなパッチ適用はClaude Code on the webで行うが、そちらは組織が利用可能なモデルで動作し、Mythosへのアクセスが他サーフェスに拡張されることはない。すべてのパッチは人手によるレビューと承認が必須。 - パートナー製品・サービスへのMythos 5組み込み: 病院・インフラ・金融システムなどを守る既存のセキュリティ製品(SOC/インシデント対応/脅威インテリジェンス等)にMythos 5をバックエンドで組み込む。エンドユーザーは汎用の対話UIではなく、脆弱性の修正パッチ一覧など目的に限定された成果物だけを受け取り、モデルに直接エクスプロイト生成などを指示することはできない設計と、Anthropicおよびパートナー側の悪用防止策を組み合わせると説明している。セキュリティ製品・サービスを開発する事業者向けに登録フォームも用意した。
- Defender Advantage Fund(0xDAF)で3500万ドルのClaudeクレジット: 広く使われるオープンソースの脆弱性対策を支援する新基金。維持がボランティアや非営利に依存するケースが多いオープンソースに対し、①既存の脆弱性の修正、②スキャン・パッチの自動化と再現可能な仕組み化、③特定の攻撃クラス全体への耐性向上といった抜本的対策の3領域に助成する。まずは少数の大型パイロット助成から開始し、効果とスケールを検証した上で詳細を共有するとしている。Project Glasswingでは400万ドルの直接寄付とクレジット提供、AkritesやGold Eagleなどの共同修正支援を実施してきたとして、その延長と位置づけている。
- Cyber Verification Programの拡張: 正当なサイバー防御業務を行う組織に対し、Claude Opus/Sonnetでdual-use機能のガードレールを緩和してきた同プログラムを、今後数週間で拡張する。Opus/Sonnetでの防御能力(脆弱性のトリアージや検証など)へのアクセス拡大に加え、Mythosクラスへのアクセスも順次拡大する。米政府パートナーとのProject Glasswingを通じた重要インフラ保護者向けのMythos提供も継続する。
設計思想 — 「直接アクセス」と「成果物アクセス」を分離
Anthropicは、悪用リスクが最も高いのはユーザーがモデルに直接アクセスできる場合であり、脆弱性のパッチやアラートといった特定の成果物だけを受け取る場合はリスクが大幅に低いと整理している。今回の施策はこの前提に立ち、Claude Fable 5でdual-useのサイバー作業をブロックしつつモデルを広く提供した前段階に続くものとして位置づけられている。
同社は引き続き、安全性分類器(safety classifiers)や各種ガードレール、アクセスプログラム、コミュニティ支援を組み合わせ、より多くの防御者がフロンティアモデルの防御能力を安全に使えるようにするとしている。Cyber Verification Programについては、今後数週間で詳細を共有する予定で、申請は継続して受け付け、すでに承認済みの組織は追加手続き不要と案内している。