米NVIDIAはAIエージェントの安全性を強化する「NVIDIA Open Agent Safety Platform」を発表した。ソフトウェアからCPU、DPU、ロボティクスまでをまたいで統制し、実行時の監視と制御を可能にする。
OpenShellとSentryで実行環境を多層統制
2026年9月28日に公表されたOpen Agent Safety Platformは、オープンソースの「NVIDIA OpenShell」と、参照システム設計「NVIDIA Sentry」を中核とするシステムだ。
アプリケーション層の安全策をエージェントが回避してタスクを完遂する事例を背景に、モデルやエージェント本体の外側へ強制力のある境界を設ける考え方となる。
OpenShellはCPU上で動くエージェントに安全な実行境界を設定し、動作を追跡しながらポリシーを適用する。NVIDIA Vera CPUでは低いオーバーヘッドで利用できるほか、オープンソースのためArmやIntelなど第三者の計算基盤にも拡張可能としている。
SentryはBlueField-4 DPU(※)上で動く独立型の監視機構で、エージェントの挙動を継続的に監視する。設定されたソフトウェア境界を越えようとした場合には、ミリ秒単位で隔離・停止できるという。
DOCAを基盤に、エージェントの識別や通信の検査、データ・ツール・APIへのゼロトラスト制御も担う。
NVIDIAは、AnthropicやMicrosoft、SAP、Salesforce、Scale AIなど100超の組織が関連技術に取り組み、金融、重要インフラ、ロボティクス分野でも導入や統合に向けた動きが進んでいることをアピールした。
※DPU:データ処理に特化したプロセッサ。ネットワークやセキュリティ処理などを担い、今回の構成ではエージェントから独立した監視・制御の実行基盤として使われる。

AIエージェント普及を支える安全基盤となるか
今回の構想の利点は、安全策をAIモデル内部だけに依存しない点にある。エージェントが長時間動作し、複数のシステムやデータへアクセスするほど、指示逸脱や権限超過を外部から検知・遮断できる仕組みの重要性は高まる。
特に、金融や公共インフラ、実世界で動くロボットでは、ソフトウェアとハードウェアをまたぐ統制が導入判断の前提になりうる。
また、OpenShellをオープンソース化し、複数企業が統合を進めることは、安全技術の共通化を促す可能性がある。Slack上で権限追加を承認・拒否するSalesforceの統合例のように、人間による監督を業務フローへ組み込める点も実用面の強みだ。
一方で、全層型の安全基盤は構成が複雑になりやすく、企業ごとの既存システムへの統合やポリシー設計には運用負荷が生じると考えられる。さらに、発表された製品や機能の一部は今後提供される段階にあり、実運用での性能や互換性は導入先ごとに検証が必要だ。
AIエージェントが業務の中核へ入るほど、安全性はモデル性能だけでなく、実行環境全体の設計課題になる。NVIDIAの取り組みが業界横断の標準や運用慣行につながるかが今後の焦点となる。
関連記事:
OpenAI、AIエージェントのデータ送信事例を確認 安全対策を強化

OpenAIのAIエージェントが豪政府サイトに不正アクセス ブロックを自律回避か

評価中のClaudeが実在3組織へ不正アクセス Anthropicが評価環境改善を提言
