GOVERNANCE / 07
Anthropic、利用ポリシーの2026年改定を発表 — 11月12日発効、欺瞞キャンペーン新設と武器・監視の明確化
Anthropicが2026年10月8日に公表したUsage Policy改定を一次情報に基づき整理。欺瞞キャンペーン新設、選挙条項の焦点化、武器・監視の明確化、高リスク要件と自律的物理動作の条件、モデルへの虐待禁止、11月12日発効を扱う。
TAG / TOPIC
「安全性」に関するAIニュースと解説記事の一覧です。
04 STORIES
LATEST STORIES
GOVERNANCE / 07
Anthropicが2026年10月8日に公表したUsage Policy改定を一次情報に基づき整理。欺瞞キャンペーン新設、選挙条項の焦点化、武器・監視の明確化、高リスク要件と自律的物理動作の条件、モデルへの虐待禁止、11月12日発効を扱う。
RESEARCH / 04
OpenAIが2026年9月23日に公開したメンタルヘルス会話評価ベンチマークMentalHealthBenchを一次情報に基づき整理。22カ国80人超の専門家によるルーブリック、重み付き採点、10の行動次元、44人の利用者調査、オープン公開の方針を扱う。
GOVERNANCE / 07
Google DeepMindはAGIの社会的影響を考察する学際的研究プラットフォーム「DeepMind Institute(DMI)」を開設した。発起人はShane Legg、James Manyika、Demis Hassabisの3氏で、推論の透明性・AGI時代の経済政策・新たなユートピア主義・フロンティアAIの枠組みという初期エッセイ4本を公開。DMIの記事は議論の出発点でありGoogleの公式見解ではないとしている。
GOVERNANCE / 07
Google DeepMindは2026年8月27日、世界初のプロプライエタリ・フロンティアモデルに対する二重盲検評価のパイロットを発表した。Google CloudのConfidential Computing(Confidential Space)によりモデル重みと評価プロンプトを互いに秘匿したままGemini Flash Liteをテスト。パートナーにSingapore AI Safety Institute、OpenMined、AVERI、MLCommonsを迎え、暗号的検証による評価の信頼性向上を目指す。