企業のAI導入と成長指標を示す青い抽象ビジュアル
NAW / BUSINESS 05

IMAGE: AI生成ビジュアル

BUSINESS / Anthropic

Anthropicが初の組込み評価者としてAccentureと提携、各10億ドル超を投資へ

Faculty主導でモデルの評価・レッドチーミング・整合性評価を実施。従業員並みアクセスで訓練過程を直接観察する「embedded evaluation」の第一弾。非独占でMETRら非営利評価機関とも協議中。

Anthropicは2026年9月18日、Accentureとの提携により、同社を独立した組込み評価者(embedded evaluator)として迎えると発表した。CEOのエッセー「We Must Pace the Frontier」で示した「評価者をAnthropic内に組み込む」という方針の第一歩になる。提携はAccentureの専門AI組織Facultyが主導し、モデルの評価とレッドチーミング、整合性(アライメント)評価、安全策のテストを含む。

提携の内容

  • 主導組織: Accentureの専門AI事業であるFacultyが率いる。
  • 評価範囲: モデルの評価とレッドチーミング、整合性評価、モデル安全策のテスト。
  • 企業現場の視点: Accentureは多業界でのAI導入支援を通じて、企業が実際にAIをどう使うかを理解しており、その視点を評価に持ち込むとAnthropicは説明している。
  • 投資規模: AnthropicとAccentureはそれぞれ、今後5年間でこの分野の能力構築に少なくとも10億ドルを投資する見込みだ。

「組込み評価」とは何か

  • 従業員並みのアクセス: 従来の外部評価者と異なり、組込み評価者はAI企業内で従業員に匹敵するアクセスを持ち、訓練中のモデル形成過程を観察し、開発・運用判断を追い、従業員と直接対話できる。
  • できること: 企業の安全コミットメントの遵守検証、死角の特定、インシデント報告、便益とリスクの情報開示を通じて、企業の説明責任を検証可能にする位置づけだ。
  • 責任の所在: 組込み評価者はAnthropicの説明責任を軽減するものではなく、検証可能性を高めるものだ。モデルの安全性の責任は引き続きAnthropicにあると明記されている。

資金と標準をめぐる留保

  • 標準は未確立: 組込み評価者がどの情報にアクセスすべきか、発見をどう報告すべきかの標準はまだ存在しない。資金調達の確立した仕組みもない。
  • 当面の資金手当て: 長期的にはプール型・政府資金が望ましいとの立場だが、現状存在しないため、AnthropicがAccentureの活動に直接資金を提供する。一方でMETRや他の非営利評価機関とも、それぞれ独自資金での試行に向けて協議中だ。
  • 非独占: 提携は非独占で、Anthropicは今後数週間で追加の評価者を発表予定、Accentureも他のAI開発者と同様の立場で協業する。

解釈と限界

  • 組込み評価は新しい試みで、運用の詳細はまだ固まっていない。実効性の判断は今後の運用報告を待つ必要がある。
  • 直接資金提供の構造には利益相反の懸念が伴い得る。Anthropic自身がこの点を認識し、プール型・政府資金への移行と非営利評価機関との並行協議を示しているが、具体策はこれからだ。
  • 投資額は両社の「見込み」であり、確定支出ではない点に注意が必要だ。

出典