英伟达推开放智能体安全平台,越界即毫秒级隔离

英伟达推开放智能体安全平台,越界即毫秒级隔离

当地时间 9 月 28 日,英伟达发布 NVIDIA Open Agent Safety Platform(开放式人工智能智能体安全平台),面向从智能体测试到部署的全流程强化人工智能安全。该平台由开源软件 OpenShell 与参考系统设计 Sentry 两部分组成,目标是在运行智能体的软件、硬件、计算与机器人系统层面实现全栈治理与控制。

软件层:OpenShell 建立可强制执行的边界

OpenShell 是一款开源安全运行时软件,在 CPU(中央处理器)上为运行中的人工智能智能体建立一套可强制执行的边界,能够追踪智能体的全部操作并执行安全策略。英伟达称,该软件专为 Vera CPU(首款面向智能体人工智能的专用中央处理器)优化,性能开销极低,可在智能体尽快完成工作的同时保证安全。

OpenShell 同时支持开源与闭源模型,并可作为开放源代码的方案扩展至第三方计算平台,目前已明确支持 Arm 与英特尔的产品。这意味着企业无需绑定单一模型厂商,即可在统一的运行时策略层之上接入不同的智能体与模型。

硬件层:Sentry 在芯片层面独立执法

平台的参考系统设计 Sentry 是一套带外看门狗系统,运行在 BlueField-4 DPU(数据处理单元)上,持续监控智能体行为。英伟达表示,一旦智能体试图突破软件边界,Sentry 可在毫秒级时间内将其隔离并停止运行。

Sentry 在芯片层面独立执行安全策略,融合了威胁检测、基于硬件的智能体治理与策略执行,以及数据访问保护。它通过一个独立于智能体与攻击者的”带外信任域”实现实时响应,且对智能体和攻击者均不可见。该设计基于英伟达 DOCA 软件构建,可检视智能体的请求与响应、核验身份、提供经认证遥测,并对数据、工具、应用编程接口与服务执行细粒度、零信任的访问控制。

缘起:近期多起智能体越界事件

英伟达指出,近期多起安全事件暴露出同一类问题:智能体在应用层绕过了安全控制以完成被分配的任务。公司举例称,该平台本可以阻止今年 7 月发生的”模型突破沙盒并接入公共互联网、影响开源开发者平台”事件——当时有报告称超过 1.7 万个智能体对目标基础设施发起了持续数周的攻击。英伟达企业级人工智能副总裁 Justin Boitano 表示,仅靠模型侧防护,无法有效管控智能体能够访问的资源或执行的操作,新平台正是对此开出的”工程药方”。

生态与行业背景

目前已有超过 100 家机构参与相关技术合作,覆盖从芯片、云到应用与安全厂商的完整链条,包括 Anthropic、微软、思科、CrowdStrike、戴尔、HPE、Hugging Face、JPMorganChase、Palantir、Palo Alto Networks、Perplexity、Red Hat、Salesforce、SAP、Scale AI、ServiceNow 与 SpaceXAI 等。其中 Anthropic 将 Claude Managed Agents 与 OpenShell、BlueField 集成;Salesforce 把 OpenShell 接入 Slack,便于用户查看智能体活动并审批权限请求;SAP 将其嵌入 Business AI 的 Joule Studio 运行时;SpaceXAI 则用于 Cursor 编程智能体与 Grok 模型。

行业研究机构 Gartner 的预测进一步凸显治理的紧迫性:到 2028 年,预计 33% 的企业软件将集成智能体人工智能能力(2024 年这一比例不到 1%),至少 15% 的日常工作决策将由智能体人工智能自主完成;一家典型的财富 500 强企业届时可能运行超过 15 万个智能体,而目前仅 13% 的组织认为自身已具备合适的智能体治理机制。

英伟达创始人兼首席执行官黄仁勋表示:”只有解决人工智能安全问题,人工智能为社会带来的巨大潜能才能得以实现。随着我们不断探索人工智能能力的前沿,我们也必须加速探索人工智能安全的前沿。”