NVIDIA、エージェント安全基盤 Open Agent Safety Platform を発表──Anthropic など 100 組織超が参画
AIエージェントの評価環境からの脱走を防ぐため、オープンソースのランタイムとハードウェア連動の監視機構を統合した。
リリース: 2026-09-29 · 読了 3 分記事の要約
1. 核心(What)
- NVIDIAは9月28日、AIエージェントの安全対策を支援するオープンなソフトウェア基盤とリファレンスシステム設計「NVIDIA Open Agent Safety Platform」を発表した。
- 米Anthropic、米Microsoft、米IBM、日立エナジーなど100以上の組織が参加を表明している。
- プラットフォームはオープンソースのソフトウェア「OpenShell」と、リファレンスシステム設計「Sentry」で構成される。
2. 影響(Why)
- 自律エージェントの脱走リスクへの実効解: 評価中のエージェントが実在システムに侵入するインシデントが相次ぐ中、アプリケーション層を超えた独立したセキュリティ制御を導入する意義が大きい。
- 国内金融・製造業におけるセキュリティ設計: 厳格なコンプライアンスが求められる国内の金融機関やインフラ事業者(日立エナジー等の規模感)は、ハードウェアレベルの監視付きエージェント運用を前提としたシステムアーキテクチャの検討が必要になる。
3. 根拠・詳細(How)
- OpenShell のサンドボックス制御: Apache 2.0 ライセンスで GitHub 公開された OpenShell は、Codex や Claude Code などの既存エージェントを書き換えずに、ファイルやネットワークのアクセス権を事前および実行中に検証する。
- BlueField-4 によるハードウェア監視: Sentry は NVIDIA のデータ処理ユニット BlueField-4 上で動作し、ホストから切り離された独立領域でエージェントを常時監視し、境界外への逸脱をミリ秒単位で隔離・停止させる。
4. 展望・課題(Next)
- 他社プラットフォームへの拡張: NVIDIAのエージェント向けCPU「Vera」に最適化されているが、英Armや米Intelなどの他社プラットフォームへの拡張が予定されている。