AIが社会にもたらす並外れた可能性は、AIの安全性(AI Safety)を解決して初めて実現される──NVIDIA ジェンスン・フアン会長の言葉だ。NVIDIAは、「NVIDIA Open Agent Safety Platform」を発表した。
これは、AIエージェントの行動をソフトウェア/ハードウェア双方で制御するためのオープンリファレンスデザイン(オープン参照設計)だ。プラットフォームの「構想」と言ってもよいだろう。ユーザーやパートナーの環境内で、自身のユースケースや要件に合わせて、AIエージェントの“決定論的”なコントロールを自由にカスタマイズできるという設計思想である。
このプラットフォーム構想の中で、ソフトウェア側の制御を担うのが、併せて発表されたオープンソースのセキュリティランタイム環境「NVIDIA OpenShell」だ。VeraのようなCPU上で動作する。
従来、AIモデルのセーフガードは、確率論的なシステムに“良い振る舞い”を学習させる「モデルの調整」を行うことが一般的だったが、これには限界がある。そのため、同社はエージェントの挙動を強制的に制御できる決定論的なシステムとしてOpenShellを導入するに至った。
OpenShellは、カーネルレベルの隔離を備えたサンドボックス内でエージェントを実行するとのこと。AIエージェントと、それが影響を与え得るシステム(ファイル、資格情報、ツール、API、モデル、ネットワークなど)の間に位置する。組織や管理者側でルールを定義すると、あらゆるエージェントが試みるすべてのアクションに対し、そのルールを強制適用するという。「ポリシー証明機能(Policy Prover)」という機能を備え、たとえば開発者が、エージェントが動き出す前に「このエージェントはインターネットにアクセスできない」ことを事前に検証・証明できるとのことだ。
サンドボックスの外側に配置されているモデル、アプリケーション、ビジネスデータへのエージェントによるアクセスも、すべてOpenShellの統制対象となり、通信を追跡してログを記録する。これにより、セキュリティチームとしては、AIエージェントの権限を正しく検証し、説明できるメリットがある。
そして、ソフトウェア側のルール適用や隔離を担うOpenShellに対し、ハードウェア側の監視を担うのが「NVIDIA Sentry」である。AIエージェントが動作するメインCPUとは独立した、BlueField-4 DPU上で動作するインフラ監視システムだという。
Sentryは、OpenShellで適用したポリシーを、ハードウェア内でも強制する。不審なエージェントの振る舞いをミリ秒単位で隔離・遮断できるとのこと。エージェントのアクションや思考の連鎖、推論を監視し、ドリフトを検知して即座に介入する。
OpenShellが境界を設定し、Sentryが監視する──この2つが組み合わさることで、多層防御が実現するというわけだ。
この記事は参考になりましたか?
- この記事の著者
-
名須川 楓太(編集部)(ナスカワ フウタ)
サイバーセキュリティとAI(人工知能)の分野を中心に、ソフトウェア/ハードウェアを問わず国内外の最新技術やルールメイキング動向を取材。そのほか、DX推進、IRなどのコーポレート領域でも情報を発信。※取材のご案内等は個人のメールアドレスか、EnterpriseZine編集部の問い合わせ窓口にお願いいた...
※プロフィールは、執筆時点、または直近の記事の寄稿時点での内容です
この記事は参考になりましたか?
この記事をシェア
