NAW / GOVERNANCE 07
IMAGE: AI生成ビジュアル
GOVERNANCE / Anthropic
Anthropic、Claude悪用対策レポート2026年9月号を公開 — 7分野の破壊工作、通常兵器開発の6事例も
2025年12月〜2026年8月に阻止した活動を対象に、サイバー・影響工作・監視・詐欺・生物・通常兵器・蒸留の7分野の事例を共有。ShinyHunters系の日和見攻撃、イランの国内監視マルウェア、中国・ロシア・イエメン関与の通常兵器関連6件、AIサプライチェーン自体を狙う手口も報告している。
Anthropicの脅威インテリジェンスチームは、Claudeの悪質な利用を検知・阻止した事例をまとめた「Detecting and countering misuse of AI: September 2026」を公開した。2025年3月・8月・11月の前回報告に続くもので、2025年12月から2026年8月に阻止した活動のうち、特に注目すべき新規性の高い事例を7つの危害分野で共有している。以下は同公開ページの記載内容の整理である。
報告の概要 — 7分野、使用モデル、脅威主体
- 対象期間と分野: 2025年12月〜2026年8月に阻止した活動を対象とし、サイバー作戦、影響工作、監視、詐欺・不正、生物学的悪用、通常兵器開発、蒸留(distillation)の7分野を扱う。いずれの事例でも活動を阻止し、得た知見を安全策に反映させ、必要に応じて当局や業界パートナーと情報を共有したとしている。
- 使用モデル: 悪用にはClaude Haiku・Sonnet・Opusが使われた。Claude FableおよびMythos級モデルが関与した悪用は、1件の不正蒸留事例を除き見つかっていないという。
- 脅威主体: 国家支援が疑われる集団、金銭目的の犯罪者、市販スパイウェアベンダー、国家プロパガンダ機関、政治的動機を持つ個人などが含まれるとしている。紹介事例は典型的な悪用ではなく、これまでに特定した中で最も注目すべき新規性の高い活動の例だと位置づけている。
サイバー作戦 — 日和見攻撃の高度化と自律攻撃基盤
- GTG-50014(ShinyHunters系): 標的を絞らない日和見型の攻撃者が、Claudeの能力で対象環境の迅速な走査・侵入・乗っ取りを加速させた事例。N-dayパッチ当て競争での大量侵害、公開コンテナ・コードリポジトリ・モバイルアプリ・Webサイトからの認証情報探索、脆弱なインターネット公開機器の大量走査・侵害、LiteLLMやOpenClaw導入へのプロンプトインジェクションなどが挙げられている。AIの登場前からある犯罪エコシステムが規模と深刻さを増し、「security through obscurity(秘匿性による安全)はもはや通用しない」と報告書は述べている。
- GTG-10007(エクスプロイト工場・自律攻撃枠組み): これまでサイバー作戦の規模と影響を制約してきた「使える攻撃エクスプロイトの供給」と「熟練オペレーターの供給」という2つの制約を、AIが緩和しつつあることを示す事例として紹介している。
- AIエコシステム自体への攻撃: AIベンダー・評価者・信頼できるアクセスプログラムを経由して制限付きモデルに触れようとする集団もいるとして、AIラッパーサービスのLiteLLM実装にプロンプトインジェクションで侵入し、本番APIキーを窃取した事例を挙げている。侵害されたアクセス経由で供給される不正転売、GitHub・アプリ・Dockerコンテナ・Webサイト・チャットボットに露出した正規顧客のキーやセッショントークンの収集、盗んだキーへの攻撃負荷の転嫁(あるハクティビスト集団の活動は1か月間ずっと盗んだキーで継続)など、AIのキーとエージェント連携を本番認証情報と同等に扱うべきだと呼びかけている。
監視と通常兵器 — イランの国内監視マルウェアと6件の兵器関連事例
- GTG-30006(国内監視の道具立て): イランの脅威主体が、16の単独オペレーター組織に分散した無償Claude.aiアカウントを使い、国内イラン人を狙うマルウェア・配布基盤・フィッシングポータルを開発したとしている。検閲回避ツールを装うページや架空のペルシャ語ニュースブランドを餌にし、イラン国内IPの訪問者にだけ悪性内容を配信する仕組みだった。Claudeは直接的に悪性と分かる要求の約9割を拒否したが、作業を無害に見える小片に分割して複数セッションで指示されると安全策の動作が安定しなかったという。モジュール式Windowsインプラント「SECOMS64」(キーロガー、画面撮影、Chrome認証情報抽出、Defender・Intune偵察など)やAndroid向けの連絡先・SMS・メディア窃取パッケージも報告されている。
- 通常兵器開発の新カテゴリ: 前回報告以降、銃器・ミサイル・武装ドローン・爆弾などの通常兵器や、その標定・制御システム向けソフトウェア開発にClaudeを使う脅威主体を新たに確認したとして、6事例(中国3件、ロシア2件、イエメン1件)の詳細を共有している。兵器設計開発そのものと、兵器計画を支える情報収集・調達の支援が含まれ、違反アカウントの停止、安全策への反映、官民パートナーへの情報提供を行ったとしている。
- Frontier Red Teamの新評価: 報告と並行して、断片情報からの人物特定のような戦術情報標定や、移動標的を攻撃するドローン工学のような通常兵器開発を測る新評価を開発した。モデルは模擬情報・兵器開発タスクで着実に進歩しているとしている。
読み方の注意
- 上記はすべてAnthropic側の公開報告の整理であり、脅威主体の帰属や技術的詳細は同社の主張である。本記事執筆時点で、名指しされた側の見解は一次情報で確認できていない。
- 攻撃手法の再現に使える具体的な手順や機微な技術詳細は本記事には含めていない。防御者向けの侵害指標(IOC)全文はAnthropicの公開ページで提供されている。
- 影響工作・詐欺・生物学的悪用・蒸留の各分野の個別事例は公開ページの各節で詳述されており、関心のある読者は一次情報を参照されたい。