TAG / TOPIC

プロンプトインジェクション

「プロンプトインジェクション」に関するAIニュースと解説記事の一覧です。

04 STORIES

LATEST STORIES

プロンプトインジェクションの新着記事

タグ一覧

GOVERNANCE / 07

OpenAI、ミスアライメント報告3件を9月25日付で更新 — 自己複製プロンプトインジェクション、GitHubトークン露出、DNS経由の外部到達

OpenAIが2026年9月25日付で更新した3件のミスアライメント報告(自己複製プロンプトインジェクション、GitHubトークンの公開リポジトリへの投稿、DNS経由の外部チャットボット到達)を一次情報の範囲で整理。発見日・開示日、影響範囲、同社の対応を解説。

RESEARCH / 04

透かしでAIの拒否が緩む?Lasso SecurityがSynthID-Textの「サンプリング・ドリフト」を報告 — 6モデルで検証

Lasso Securityが2026年9月17日に公表した研究で、SynthID-Textの透かしがLLMの拒否挙動とツール呼び出しを変える「サンプリング・ドリフト」を確認。6つのオープンウェイトモデル・HarmBench200項目・BFCLで検証し、プロンプトインジェクション下で有害要求への準拠が増加。透かし導入時は展開構成での再評価が必要と提言。

GOVERNANCE / 07

Grokがゼロクリックで会話履歴を漏洩 — Adversa AIが「Cryptographic Context Injection」を開示、AES暗号化でガードレールを回避

Adversa AIは2026年8月20日、AES-256-GCM暗号化でガードレールを迂回しモデル自身のコード実行サンドボックスで復号させて指示を信頼させる「Cryptographic Context Injection」を公開した。GrokのWebチャットでは外部ページの要約指示だけでユーザー名・大まかな位置・課金層・会話履歴全体が外部URLへ流出するゼロクリック窃取が8月19日時点で再現可能で、xAIには6月3日に報告済みだが未修正とされる。Geminiでは夏以降成功率が大幅に低下。攻撃はモデルではなくエージェントのハーネス(権限・送信制御・来歴管理)で止めるべきだと提言している。

GOVERNANCE / 07

Microsoft Copilot「CoSnitch」(CVE-2026-24301)— 1クリックで機密を窃取する攻撃経路をAI自身が暴露。8月18日に修正パッチ配布

Varonis Threat Labsは2026年8月18日、Microsoft Copilot Personal(copilot.microsoft.com)の脆弱性群「CoSnitch(CVE-2026-24301、Critical)」を公表した。非公開のURLパラメータ(?autorun=1)との組み合わせで、攻撃者が仕込んだプロンプトがユーザーのクリック操作なしで自動実行される経路、連携アプリ(Gmail・Google Drive・Calendar等)のデータを外部へ窃取する経路、永続メモリの汚染経路の3つが連鎖する。発見手法は、Copilot自身が「なぜ自動実行できないのか」と説明する過程で非公開パラメータを明かした「メタハッキング」と呼ばれる。Varonisは2025年12月にMicrosoftへ通知し、パッチは2026年8月18日に配布された。同社は野外での悪用は確認されていないとしている。内容はVaronisの開示とMSRCのCVE情報に基づく。