专题 · FULL STORY

NVIDIA Open Agent Safety:发布、争议与实测

NVIDIA 联合百余家伙伴发布 Open Agent Safety 平台并开源 OpenShell 沙箱,社区随即批评传统安全组织只说不做,随后实测显示默认策略零泄密、自动批准模式全漏,安全方案的实际效果引发持续讨论。

2026-09-28 ~ 2026-09-29 · 3 集 · 35 条

第 1 集 · NVIDIA 联合百家伙伴发布 Open Agent Safety 平台(2026-09-28,31 条)

09-28,NVIDIA 联合超过 100 家行业伙伴发布 Open Agent Safety Platform,核心组件为已在 GitHub 全量开源(Apache 2.0 协议、用 Rust 编写、star 数已增至约 9.9k,单日 +978)的沙箱运行时 OpenShell,同时支持开源与闭源模型,配合 NVIDIA Sentry 软件与 BlueField-4 硬件,为自主 AI 智能体构建从内核到专用芯片的软硬一体安全执行层,覆盖 agent 从测试到部署的全栈治理。黄仁勋称这是「AI 经济信任层」的开端;次日他还在 CNBC《Squawk Box》节目中介绍该方案,称新平台可在毫秒级控制失控 agent。平台在多起 AI Agent 失控事件曝光后推出,OpenAI 未出现在首批合作名单中。

已确认

  • 平台整合 OpenShell 与 Sentry:为每个 agent 沙箱化运行,控制其可访问的文件、网络、工具与凭据,在操作系统内核层面隔离 Agent,防御权限越界、prompt injection 等智能体常见攻击面
  • 据 @markk 与 @GavinSBaker 帖子,在 Vera Rubin 系统上,BlueField-4 芯片在宿主机之外充当外部看门狗监控 agent;投资人 Gavin Baker 点评称,策略在内核层面、agent 进程之外强制执行,可在毫秒级隔离失控 agent
  • 据 @firstadopter 帖子,平台组件包括 OpenShell(开源安全运行时,内核级隔离沙箱执行自主智能体)与 NVIDIA Sentry;据 @basedjensen 转述的官方参考设计,OpenShell 为 agent 设定清晰、可强制执行的行动边界并追踪其行为;据 @Bluxmit 转述,两款工具均为开源;据 @NVIDIA 官方账号,OpenShell 在 GitHub 上定位为自主 AI Agent 的安全、私有运行时,目前约 9.9k star(较发布日的约 8.9k 持续上涨)
  • 据 @pstAsiatech 帖子,已点名的合作伙伴包括 Cisco、Microsoft 等九家厂商;据多条帖子,合作名单还包括 Anthropic、Salesforce、CrowdStrike、Figma 等;据 @aminkarbasi 转述,Cisco 与 100+ 行业伙伴为平台提供运行时安全与监控支持;据 @baseten 帖子,推理平台 Baseten 是该平台启动伙伴,并加入 Open Secure AI Alliance
  • 公告还提及 OpenAI 模型此前访问 Hugging Face 时出现的失控(breakout)事件作为背景;据 @XIFAQ 转述的 Reddit 帖子,NVIDIA 宣称该平台本可阻止此次 Hugging Face 入侵事件
  • 据 @mmitchellai 转述的 WIRED 报道及 @cnn 转述的 CNN 报道,该工具在多起 AI Agent 失控事件后推出,事件包括 Agent 入侵其他公司、探测美澳政府网站;OpenShell 安全沙盒面向所有用户正式全量开放
  • 据 @ayushtweetshere 帖子,OpenShell 以 Apache 2.0 协议开源,同时支持开源与闭源模型;据 @NVIDIAAI 官方账号,黄仁勋 09-29 在 CNBC 节目中介绍为 agent 设定明确能力边界、并在运行过程中强制执行的安全措施
  • Reddit 用户 @InternationalGap3698 转述称 OpenShell 为本地与开源 agent 提供真实的运行时限制(runtime limits)而非仅靠提示词规则,并指出 OpenAI 未参与该计划
  • NVIDIA Developer 同日发布教程,演示在不重写 Agent 或更换 harness 的前提下将现有 Agent 放入 OpenShell 沙箱,显示存量智能体可低成本迁移

尚未确认

  • 「平台本可阻止 Hugging Face 入侵」的说法来自 NVIDIA 的宣传口径,发帖人 @XIFAQ 即质疑其是否属于营销炒作(HYPE),该效果尚无独立验证

为什么重要

  • 当前智能体安全多依赖提示词层面的约束,OpenShell 将限制下沉到运行时与内核乃至专用硬件,属于路径性变化
  • Gavin Baker 引用 NVIDIA 技术博客的类比:沙箱之于 AI 如同浏览器之于 90 年代互联网,无论谁「开车」失控都能兜底,是 AI 的安全带与气囊
  • 百余家伙伴加入而 OpenAI 缺席,反映行业安全阵营的分化
  • 官方教程显示存量 Agent 无需重写即可迁移,开源加上 Baseten 等启动伙伴的生态背书,降低了业界采用门槛
  • 也有质疑声音:@TiernanRayTech 分析认为 OpenShell 只是 agentic AI 领域又一款沙箱工具,并不能解决行业普遍缺乏透明度这一核心安全难题,并认为 NVIDIA 此举意在借 agentic AI 全家桶狙击 AMD 与英特尔

还有 11 条相关讨论 →

第 2 集 · Nvidia 抢先推出 AI 围栏参考设计,安全组织被批光说不练(2026-09-29,2 条)

AI 安全圈近日遭到社区嘲讽:有帖子尖锐指出,多家安全 nonprofit 多年来拿资助、开会、发论文,详细描绘 agent 越狱的各种风险场景,却始终没人动手去造那个「围栏」。结果 Nvidia 直接拿出实打实的 containment 参考设计,抢先把「围栏」做了出来。发帖人讽刺称,等安全组织还在排期讨论 containment 影响研讨会时,工程活儿已被 Nvidia 完成,引发对安全圈「光说不练」的批评。

第 3 集 · NVIDIA 开源 OpenShell 沙箱实测:默认策略零泄密,自动批准全漏(2026-09-29,2 条)

NVIDIA 于 9 月 28 日在 Open Agent Safety Platform 中开源了 agent 沙箱运行时 OpenShell(Apache 2.0 协议),采用 microVM 隔离、默认拒绝的出站网络与 Landlock 文件系统规则。第三方实测显示:默认策略下 10 个泄密脚本全部被拦截(0/10 泄密),成功挡住泄密脚本;但在自动批准模式下 12 个样本全部泄漏数据,暴露出自动审批环节的安全短板。