NVIDIA が導入するシリコンレベル・セキュリティ:Open Agent Safety Platform とは?

NVIDIA Launches In-Silicon Security Platform to Monitor and Control Autonomous AI Agents

2026/09/28 gbhackers — NVIDIA が発表した Open Agent Safety Platform は、自律型 AI エージェントに対する帯域外監視/実行時のポリシー適用/ハードウェア制御を目的とするセキュリティ・アーキテクチャである。このプラットフォームは、オープンソースの NVIDIA OpenShell 実行環境と、BlueField-4 Data Processing Unit (DPU) 上の NVIDIA Sentry による保護機能を組み合わせ、エージェントが許可されたアクセス権限を超えた操作や、許可された動作範囲からの逸脱を防止する。

NVIDIA のシリコン・レベルのセキュリティ・プラットフォーム

今回の発表は、コードの記述/API の呼び出し/認証情報の使用/企業データへのアクセス/サブエージェントへのタスク委任が可能であり、長時間稼働するエージェント型 AI システムへの懸念の高まりに対応するものである。NVIDIA は、タスクが曖昧な場合/ツールが機能しない場合/ポリシーが競合する場合/モデルが長時間動作する場合には、エージェント自身による動作の確実な制御を期待すべきではないと主張している。

同社は、この意図しない逸脱をエージェントの「ドリフト」と表現し、AI システムが割り当てられた目標や動作上の制約から逸脱する状態を指すとしている。不明確な指示/ポリシーによる阻止/ソフトウェアのバグ/必要なツールの欠如/複雑なタスクを完了しようとして繰り返される失敗などにより、このドリフトが発生する可能性がある。

. NVIDIA Open Agent Safety Platform Reference Design (Source: Nvidia)
. NVIDIA Open Agent Safety Platform Reference Design (Source: Nvidia)

NVIDIA のアプローチは、安全な動作の強制をモデルやアプリケーションだけに依存するものではなく、エージェントから操作できない場所にセキュリティ制御を実装するというものである。実行環境のレイヤでは、NVIDIA OpenShell がカーネル・レベルの分離を備えたサンドボックス環境を提供し、運用担当者は、エージェントが利用できるファイル/プロセス/サービス/API/認証情報/ネットワーク上の接続先を定義できる。

OpenShell は、エージェントによるシェル・コマンドの実行/コードの生成/子プロセスの作成/サブエージェントの起動時にも、これらの制限を適用する。OpenShell のアーキテクチャには、サンドボックスのライフサイクルとポリシーを管理する Gateway と、外向きのリクエストを評価する Supervisor、そして、エージェントが動作する場所である隔離された Sandbox が含まれる。

ネットワーク・トラフィックはポリシー適用地点を経由するため、組織は同一サービスに対して、読み取り専用の API クエリなど、厳密に定義した操作のみを許可しながら、書き込み操作を禁止できる。さらに、実行環境では、認証情報をエージェント環境の外部に保持し、許可された接続先へ向けた承認済みリクエストにのみ認証情報を挿入できるようになる。

中心的な機能の 1つが、ポリシーの形式的検証である。OpenShell は権限変更を適用する前に、新しいルールが運用担当者の定義した境界を超えるアクセスを許可するかどうかを分析できる。

この分析は、新しいホスト/API メソッドに対する認証情報の使用権限をエージェントへ付与するといった、リスクの高いポリシー拡張を防ぐことを目的としている。また、ポリシー変更に人間による確認を必須とすることで、エージェント自身が自らのアクセス要求を承認できないようにすることも可能である。

NVIDIA Sentry は、BlueField-4 DPU を介してインフラ・レベルの制御機構を提供し、このセキュリティ・アーキテクチャを強化する。NVIDIA Vera Rubin POD の導入環境では、BlueField-4 がノードからモデルに至る経路上に配置され、ホストシステムから独立した継続的な監視/制御を可能にする。この配置は、信頼できないホスト環境/信頼できないエージェントのワークロードであっても、監視を維持できるよう設計されている。

このプラットフォームは、アプリケーション/実行環境/インフラという 3層モデルを採用する。アプリケーション層にはモデル/ツール/データ/エージェント・フレームワークが含まれ、OpenShell により、これらのワークロードは制御されたコンピューティング環境上で動作する。さらに、NVIDIA Sentry は BlueField DPU/NVIDIA DOCA と組み合わせ、インフラ側からの制御/ID ガバナンス/文脈情報を含む活動記録を提供する。

NVIDIA によると、OpenShell は Codex/Claude Code/Pi/Hermes といった、さまざまなエージェント・フレームワークをサポートする。同社は、チップ設計/企業業務の自動化/実世界で動作するロボットなどの分野で、すでに導入が始まっているとしており、OpenShell 関連の制御機能を利用する組織として Cadence/Slack/Gecko Robotics を挙げている。

今回の発表は、自律型 AI エージェントを信頼できる自動化ツールではなく、信頼できないワークロードとして扱う方向への転換を示している。NVIDIA は、エージェントから独立してポリシーを適用し、必要に応じてハードウェアによる制御を追加することで、不正なデータアクセス/認証情報の悪用/ポリシーの回避/安全でない API 操作/エージェント間の権限昇格などのリスク軽減を目指している。

セキュリティ・チームにとっての主な利点は、エージェントから独立して制御を適用できる点にある。エージェントは操作を提案できるが、自身がアクセス/実行できる対象を決定する制御機構を直接変更することはできない。