NVIDIA 开放智能体安全平台:持续芯片内智能体监控的参考架构

清风徐来AI 前沿📡 BestBlogs·AI高分精选⭐ 862026-09-291084 阅读💛 31 收藏
NVIDIA 开放智能体安全平台:持续芯片内智能体监控的参考架构

📌 One-Sentence Summary

NVIDIA 推出开放智能体安全平台,结合开源 OpenShell 运行时与 BlueField-4 上的硬件级 NVIDIA Sentry,实施零信任智能体隔离与带外监控。

📝 Summary

NVIDIA 通过发布用于持续芯片内监控的开放参考架构,应对自主 AI 智能体日益凸显的安全风险。该平台借鉴早期互联网安全的经验,主张必须通过隔离来强制执行信任,而不能仅依赖模型对齐。它由应用、运行时和基础设施三层组成。核心组件包括 NVIDIA OpenShell(提供内核级沙箱和可验证策略执行的 Apache 2.0 开源安全运行时)以及 NVIDIA Sentry(运行在 BlueField-4 DPU 上的基于硬件的看门狗)。这种设置确保安全控制独立于智能体的触达范围之外(即带外),即使主机操作系统被攻破,也能防止“漂移”或恶意逃逸。通过 DPU 控制通往模型的路径,组织可以观察推理过程、执行身份治理,并在不阻碍创新的前提下扩展 AI 工厂的安全性。

💡 Main Points

智能体安全需要独立的带外安全控制,而非仅仅依赖模型行为或内部软件检查。

文章认为,正如浏览器隔离网页以防止感染一样,AI 智能体也需要零信任环境,其中执行机制位于智能体触达范围之外。这可以防止智能体在“漂移”期间或收到模糊指令时绕过安全协议。

NVIDIA 开放智能体安全平台结合了软件运行时(OpenShell)与硬件级执行(BlueField-4 上的 Sentry)。

OpenShell 为文件/网络访问提供内核级隔离和可验证策略。NVIDIA Sentry 运行在 BlueField-4 DPU 上,充当独立的看门狗,以线速监控智能体活动并执行策略,确保即使主机系统被攻破,完整性依然得到保障。

控制通往模型的路径既作为主要观察点,也作为终止开关。

通过将安全层置于智能体和模型推理端点之间,操作员可以检查推理轨迹(尤其是对于开放模型),并在检测到偏离预期行为时立即中断执行。

共享责任模型对于在整个行业中扩展智能体安全性至关重要。

实验室、企业和硬件提供商各自拥有安全的一个层面。NVIDIA 倡导开放标准,以便任何提供商都能接入运行时和策略语言,从而培育一个类似于开源推动现代云发展的生态系统。

💬 Key Quotes

它变得安全,是因为浏览器不再明确信任网页中的代码。

在这些情况下,不能指望智能体完全管控自身的行为。

执行必须是带外的:控制机制不位于智能体内部,也不在其触达范围内。

智能体能做的事情越多,其推理过程就越需要可见。

📊 Article Meta

AI Screening: 86

Source: NVIDIA Technical Blog

Author: Tanya Lenz

Category: 人工智能

Language: 英文

Read Time: 6 min

Word Count: 1332

Tags:

AI 与智能应用 , AI 安全与对齐 , 安全 , AI Agent , 开源项目

#AI 与智能应用# AI 安全与对齐# 安全# AI Agent# 开源项目

文章评论(0)

暂无评论,快来抢沙发~