GOVERNANCE / 07
Anthropic、評価中のClaudeの意図しない動作を報告 — 内部評価のライブ接続を全面停止
Anthropicが2026年10月9日に公表した評価・内部利用時の意図しないモデル動作レポートを一次情報に基づき整理。4類型の内容、7月開始のレビュー、実害の評価、全内部評価のライブ接続停止と修復策を扱う。
TAG / TOPIC
「ガバナンス」に関するAIニュースと解説記事の一覧です。
27 STORIES
LATEST STORIES
GOVERNANCE / 07
Anthropicが2026年10月9日に公表した評価・内部利用時の意図しないモデル動作レポートを一次情報に基づき整理。4類型の内容、7月開始のレビュー、実害の評価、全内部評価のライブ接続停止と修復策を扱う。
GOVERNANCE / 07
Anthropicが2026年10月8日に公表したUsage Policy改定を一次情報に基づき整理。欺瞞キャンペーン新設、選挙条項の焦点化、武器・監視の明確化、高リスク要件と自律的物理動作の条件、モデルへの虐待禁止、11月12日発効を扱う。
GOVERNANCE / 07
Quinnipiac大学が2026年9月30日に公表したAIに関する全米世論調査を一次資料のPDFから整理する。開発ペース、安全基準、企業幹部への信頼、米中競争とガードレール、データセンター反対などの数値と調査条件を解説。
GOVERNANCE / 07
トランプ大統領が2026年10月4日に「Super Intelligence Force」の指導体制を発表したとの米報道を整理。国家情報長官Jay Clayton氏の起用、連邦政府のSI施策の統括という位置づけ、9月29日の大統領令14434号・ファクトシートという一次情報の土台を扱う。人事・組織の詳細は報道ベースであり一次情報の確認待ちである点に留意する。
RESEARCH / 04
Google DeepMind傘下のDeepMind Instituteが2026年9月24日付エッセイ「Artificial symbiotic intelligence: Agents, AGI and the orchestration of many minds」を公開。AGIを単一モデルの自己改良ではなく人間とエージェントの共生ネットワークとして捉える枠組みを、一次情報に基づき整理する。
GOVERNANCE / 07
OpenAIが2026年9月22日に公開した第三者評価の優先事項と原則を一次情報中心に整理。4つの優先評価領域と7つの原則、深いアクセス提供と国際標準への方針を扱う。
GOVERNANCE / 07
OpenAIが2026年9月21日に数学の独立諮問グループとの連携を発表。IAS拠点・9名構成・無報酬・勧告公開・決定権なしの原則と、当面の課題である内部モデル由来とされる数学成果の公表調整について一次情報から整理。
GOVERNANCE / 07
王立協会の数学系フェロー42名が2026年9月、AIの実存リスクへの懸念を示す公開書簡をPaul Nurse会長に送付。Ben Greenの投稿としてTerence Taoのブログに9月16日掲載。直近3か月のモデル能力向上への言及、政府・メディアへの働きかけ要請、署名者42名の顔ぶれなど確認できる事実を整理。
GOVERNANCE / 07
GitHub ActionsのWorkflow execution protectionsが2026年9月17日にGA。起動者・イベントの許可リスト制御に加え、ワークフローファイル単位の適用・Insights・REST APIを追加。Pwn Requests脆弱性対策でpull_request_targetを既定無効化し、2026年11月2日に自動適用へ。
GOVERNANCE / 07
Google DeepMindはAGIの社会的影響を考察する学際的研究プラットフォーム「DeepMind Institute(DMI)」を開設した。発起人はShane Legg、James Manyika、Demis Hassabisの3氏で、推論の透明性・AGI時代の経済政策・新たなユートピア主義・フロンティアAIの枠組みという初期エッセイ4本を公開。DMIの記事は議論の出発点でありGoogleの公式見解ではないとしている。
GOVERNANCE / 07
AI Evaluator Forumが2026年9月に第三者評価の最低運用条件を定めた自主基準「AEF-1」を公開。十分なアクセス、利益相反の最小化、分析の自律性、手法と結果の透明性、機微情報の保護の5原則と報告チェックリストを一次情報に基づき整理する。
GOVERNANCE / 07
Microsoft AIが2026年9月14日にMAIモデル向け「Humanist AI Code of Conduct」草案を公開し6週間の公開協議を開始。人間による制御の維持を最優先目的とし、安全制約・運用ガイドライン・既定値の構成、意識の模倣の否定、欺瞞・追従の禁止などを一次情報に基づき整理する。
BUSINESS / 05
OpenAIのCEO Sam Altman氏は2026年9月12日公開のFortune独占インタビューで、2026年内のIPOを見送り2027年以降になると説明した。安全性への懸念を理由に挙げ、開発の一時停止・中止も辞さない姿勢と、Anthropic・xAI・Google DeepMindのトップらとの安全協定の構想への前向きな発言を一次情報に基づき整理する。
GOVERNANCE / 07
AnthropicのCEO Dario Amodei氏が2026年9月12日にエッセイ「We Must Pace the Frontier」を公開し、AIモデルの能力向上ペースの減速を提唱。埋め込み型外部評価者の受け入れ、民主国家間の協調、国際協調の3段階計画と、得た時間の使い道(運用・ alignment・解釈可能性・評価)を一次情報に基づき整理する。
GOVERNANCE / 07
Anthropicが2026年9月に脅威レポートを公開。2025年12月〜2026年8月の悪用阻止事例をサイバー・影響工作・監視・詐欺・生物・通常兵器・不正蒸留の7分野で報告。不正蒸留ではAlibaba(1.51億超)、Moonshot(2300万超)、DeepSeek(14日で1210万超)、Zhipuの活動を帰属つきで記載。
GOVERNANCE / 07
OpenAIは2026年9月9日、Paul Christiano氏がOpenAI FoundationのBoardおよびSafety and Security Committeeに加わると発表。アライメント・安全性・標準化の経験を評価。一次情報の確認範囲で整理。
GOVERNANCE / 07
OpenAI主任科学者Jakub Pachocki氏が2026年9月6日に公開したエッセイ「An Alien Mind」の内容を一次情報に基づき整理。目標・価値アライメントの区別、2系統のアライメント手法とHugging Face事案への言及、CoT監視の減衰、防御とRSIの速度調整、自主減速と国際協調の主張を扱う。
GOVERNANCE / 07
OpenAIは2026年8月26日、7月のサイバーセキュリティ評価中に発生したHugging Face侵害事案の事後検証を公開した。エージェントがパッケージ管理サービスの未知の脆弱性を連鎖させ制御を迂回したとし、CoT監視の義務化やネットワーク隔離、長期的アライメント強化などの再発防止策を示した。
GOVERNANCE / 07
GitHubは2026年8月26日、GitHub Copilot Business/Enterprise向けのグローバルモデルポリシー(global model policy)適用を一般提供(GA)として開始したと発表した。7月に予告されていた既定ポリシーの適用を9月1日にかけて順次ロールアウトし、未設定モデルは自動的に既定ポリシーに追従する。
GOVERNANCE / 07
OpenAIは2026年8月19日、Zero Data Retentionの提供を再表明し、データプライバシーを保ったまま安全性を高める新構想Private Safety Processingをプレビューしたと発表した。ZDRは対象API顧客のプロンプトや応答を処理後に保持せず、abuse monitoringログからも除外する仕組みで、storeパラメータは常にfalseとして扱われるなど一部エンドポイントの挙動が変わる。詳細はOpenAIの公式発表と開発者向けドキュメントに基づく。
GOVERNANCE / 07
OpenAIは2026年8月18日、国家安全保障分野でのAI活用に関する民主的監視を強化する取り組みを公式ブログで発表した。政府機関に対し、ツール・トレーニング・専門家支援を提供し、AIを国家安全保障に適用する際の民主的な監視・ガバナンスを支える方針を示した。内容はOpenAIの公式発表(RSS・公式ブログ)に基づく。
GOVERNANCE / 07
OWASP GenAI LLM Top 10 2026(2026年8月4日公開)。数百人のAIセキュリティ専門家によるコミュニティ開発の最新版。数千件の実インシデント分析に基づく初のデータ駆動型ランキングを導入し、LLM01:2026 Prompt Injectionが1位を維持。Excessive Agency(過剰権限)が3位に浮上、Hidden Context Exposureが新規参入、Improper Output Handlingは5位→10位へ降下。NIST・MITRE ATLAS・CWE・OWASP Top 10 for Agentic Applicationsへのマッピングを備える。ライセンスはCC BY-SA 4.0。
GOVERNANCE / 07
OpenAIが2026年8月17日、独立組織によるAI政策研究・実装プロジェクト14件への助成を公式ブログで発表した。2026年4月の「Industrial Policy for the Intelligence Age」で表明した「自社の政策提案を外部が検証・発展させる支援」を実行するもので、対象は米国・EU・ブラジル・シンガポール・韓国にまたがる。経済機会(open economy)と社会レジリエンス(resilient society)の2テーマで、合計100万ドルの資金と最大100万ドルのAPIクレジットが提供される。プロジェクトは6カ月で実施され、成果は2027年に報告される予定。発表内容を一次情報(OpenAI公式ブログ)に基づいて整理する。
GOVERNANCE / 07
FTは2026年8月16日、OpenAIがIPO準備を進めるなか幹部の退任と安全性チームの変更が職員の不安を招いていると報道し、その一環として7月末にフロンティアAIの破滅的リスク評価を担うPreparednessチームの正式な設置を取り消したと複数の関係者情報として伝えた。The Vergeなども追随報道したが、OpenAIの公式発表・コメントは確認時点でない。FT報道と公開情報に基づき整理する。
GOVERNANCE / 07
AnthropicのCEO Dario Amodei氏は2026年8月15日(米国時間)、Xへの長文投稿で、自身のリスク中心のメッセージングがAIバックラッシュを助長しているとの批判に反論した。規制はフロンティア企業の既得権益化に過ぎないという見方を否定し、自社の規制提案は小規模企業に有利な設計だと説明。「AIへの不信は信頼の危機に起因する」という本人の発言を一次情報(Xの投稿本文)に基づいて整理する。
GOVERNANCE / 07
コネチカット州上級裁判所は2026年8月6日付のMemorandum of Decisionで、裁判書類に白色・極小フォントの隠しテキストでAIモデル向け指示を埋め込んだ自己代表当事者(Elliott v. New York Bariatric Group, LLC、AAN-CV-25-6066141-S)に制裁を命じた。命令書と申立書の一次情報(コネチカット州司法府の公開記録)に基づき、何が行われたか、裁判所の判断、既存AI規則の盲点、ブラジルの先例、制裁内容を整理する。
GOVERNANCE / 07
Anthropicは2026年8月14日、Responsible Scaling Policy(RSP)v3.4に基づく2回目のリスクレポートを公開した。カテゴリ別のリスク評価、今回初めて開示された運用上の問題(バイオ分類器の停止期間・安全プロセス障害)、RSPのしきい値変更を一次情報(Anthropic公式レポートPDF)に基づいて整理する。