随着生成式 AI 技术的成熟,AI 智能体正从简单的对话助手向具备自主决策和执行能力的复杂系统演进。然而,这种自主性也带来了前所未有的安全挑战。AI 智能体能够访问敏感数据、调用 API 并在用户环境中运行代码,一旦遭遇恶意攻击或自身逻辑失控,后果可能极为严重。为了解决这一行业痛点,NVIDIA 近日正式宣布推出了一款名为“Open Agent Safety Platform”的开源参考设计,旨在为 AI Agent 构建一道坚不可摧的外部安全防线。
该平台的核心架构由两个关键组件组成:OpenShell 和 Sentry。OpenShell 是一个基于 Apache 2.0 许可证的开源运行时环境,它充当了 Agent 的“行为守门人”。开发者可以通过 YAML 格式的策略文件,精确地定义 Agent 的运行边界、可访问的资源以及可执行的操作。这种基于策略的沙箱机制,确保了 Agent 仅在预定义的安全范围内活动,有效防止了越狱行为和数据泄露。
相比之下,NVIDIA 的解决方案引入了硬件级的安全监控能力,这主要得益于 Sentry 模块。Sentry 是部署在 NVIDIA BlueField-4 数据处理器单元(DPU)上的一个带外看门狗。DPU 本质上是一种专用的数据处理芯片,用于卸载网络和存储任务,而 Sentry 则利用其强大的计算能力,在不干扰 Agent 正常工作流的前提下,实时监控其状态。一旦 Sentry 检测到 Agent 试图越界或出现异常行为,它能在毫秒级的时间内迅速将其隔离,从而将风险遏制在萌芽状态。
NVIDIA 方面表示,Open Agent Safety Platform 不仅仅是一个技术原型,更是一个完全开放的参考设计。这意味着全球的开发者、研究人员和企业都可以基于此进行定制化开发和集成。目前,已有超过 100 家组织加入到该平台的测试与部署中,涵盖了金融、医疗、研发等多个领域。这一举措标志着 AI Agent 安全领域正从“信任但验证”的传统模式,向“强制隔离”的零信任模式转变,为构建可信、可控的智能体生态系统奠定了坚实的基础。
信息来源:MarkTechPost,原文链接:https://www.marktechpost.com/2026/09/28/nvidia-launches-open-agent-safety-platform/