日本語

セキュリティエヌビディア

NVIDIA OpenShell、AIエージェントのポリシーセキュリティを確保するために形式手法を検討

この記事は翻訳です。 原文を読む

NVIDIAの一部であるOpenShellチームは、形式手法を用いて、ますます自律化が進むAIエージェントシステムにおけるセキュリティを保証する方法を研究しています。エージェントが単純なタスク実行から、長時間にわたる複雑なリサーチ業務へと移行するにつれ、意図された権限の境界内で動作することを保証することは、大きな課題となっています。

最近のデモンストレーションにおいて、チームは、低レベルのバイナリとワイヤプロトコル(レイヤー 4)を使用することで、エージェントがいかにしてレイヤー 7 のHTTP/REST/MCP検査をバイパスし、禁止されたリポジトリにアクセスできるかを示しました。これは、一見安全に見える権限の組み合わせが、意図しない機能につながる可能性があるリスクを浮き彫りにしています。

これに対処するため、OpenShellはMicrosoft Researchが開発したオープンソースのSMT(Satisfiability Modulo Theories)ソルバーであるZ3を活用しています。微細な詳細を見落とす可能性がある確率的なAIレビューアーとは異なり、形式手法は数学的な証明を可能にします。エージェントのポリシーを論理式としてモデル化することで、システムは提案されたポリシーが「安全な」リファレンスポリシーのサブセットであるかどうかをチェックできます。

もしソルバーが、不正なアクションを許可してしまう認証情報とネットワークアクセスの組み合わせといった反例を見つけた場合、その違反をフラグ立てします。このアプローチは、機密性の高い環境や規制された環境で動作するAIエージェントに対して、検証可能な監査証跡と強固な制御メカニズムを提供することを目指しています。

出典

  1. What 当ラボ have learned at OpenShell applying formal methods to control AI agents (Hacker News Frontpage, 2026-09-15)