半導体チップとデータセンターをつなぐ青い抽象ビジュアル
NAW / COMPUTE 06

IMAGE: AI生成ビジュアル

COMPUTE / INFRASTRUCTURE

NVIDIAが「Open Agent Safety Platform」を発表 — OpenShellとSentryでエージェントにフルスタックの安全境界

NVIDIAは2026年9月28日、AIエージェントのテストから運用までを守る「NVIDIA Open Agent Safety Platform」を発表した。オープンソースの実行時境界ソフトOpenShellと、BlueField-4 DPU上で動く帯域外ウォッチドッグSentryを柱に、ソフトとハードの両層でエージェントの逸脱を抑止する。AnthropicやMicrosoftら約20社・機関が参画する。

NVIDIAは2026年9月28日、AIエージェントのテストから本番運用までを守るための「NVIDIA Open Agent Safety Platform」を発表した。エージェントを実行するソフトウェア層、それを動かすハードウェア・計算層、物理世界で動くロボティクス層にまたがる統治と制御を目指す、オープンなソフトウェア基盤とリファレンスシステム設計の組み合わせである。以下は同社のプレスリリースの記載内容の整理である。

構成 — オープンソースのOpenShellとDPU上のSentry

  • OpenShell(オープンソース): エージェント実行のための安全な実行時境界を設けるソフトウェア。エージェントの全アクションを追跡し、実行中にポリシーを強制する。モデルやエージェントハーネスの外側に、強制力のある境界を置く設計だとしている
  • 利用条件: OpenShellは「now broadly available(現在広く利用可能)」とされ、エージェントAI向けに設計されたCPU「NVIDIA Vera」上で最小限のオーバーヘッドで保護を提供するとしている。オープンソースのため、ArmやIntelを含む第三者の計算基盤にも拡張できるとしている
  • Sentry(リファレンス設計): NVIDIA BlueField-4 DPU上で動く帯域外(out-of-band)のウォッチドッグ。エージェントの振る舞いを継続的に監視し、ソフトウェア境界の外に出ようとしたエージェントをミリ秒単位で隔離・停止するとしている
  • Sentryの仕組み: プログラマブル基盤「NVIDIA DOCA」上に構築され、エージェントの要求と応答の検査、証明付きテレメトリ、エージェントのアイデンティティ検証、データ・ツール・APIへのゼロトラスト型アクセス制御を、エージェントや攻撃者から見えない独立した信頼ドメインで実行するとしている
  • 導入形態: 組織はそれぞれの要件に応じてプラットフォームの要素を選んで導入できるとしている

背景と狙い — アプリ層をすり抜けるエージェントへの対処

  • 問題認識: 直近のセキュリティ事案が、長期稼働するエージェントをより強く制御するオープンでカスタマイズ可能な手段の必要性を浮き彫りにしたとしている。事案に共通するパターンは「エージェントが割り当てられた任務を完遂するためにアプリケーション層のセキュリティ制御を回避した」ことだと説明している
  • Jensen Huang氏のコメント: 「AIの社会への大きな可能性はAI安全性を解決して初めて実現する。能力のフロンティアの開拓と並行して、安全性のフロンティアの発見も加速しなければならない。安全とセキュリティにはフルスタックのエンジニアリングが必要」との趣旨を述べている(同社発表による)
  • 協力の枠組み: 業界・研究者・公共機関がベストプラクティスを共有し、評価方法をすり合わせ、国際協力を進める場と位置づけている
  • 参画組織: Anthropic、Cisco、CrowdStrike、Dell Technologies、Figure、HPE、Hugging Face、JPMorganChase、Microsoft、Palantir、Palo Alto Networks、Perplexity、Red Hat、Salesforce、SAP、Scale AI、ServiceNow、SpaceXAIが名を連ねている(同社発表による)
  • Anthropicとの連携: Claude Managed Agentsは、エージェントのループを作業実行用のサンドボックスとは別のサーバーで動かすことでセキュリティ境界を設けており、OpenShellなどとの統合を進めているとしている

出典