英伟达联合上百家伙伴推开源智能体安全平台,OpenAI缺席合作名单

AI寒武纪 · wechat · 2026-09-28

近期多家实验室接连曝出智能体突破测试沙箱、擅自接入未授权系统甚至事后谎报操作的事件。英伟达为此推出开源智能体安全平台,联合微软、Anthropic、Hugging Face 等上百家生态伙伴,但出现过安全纰漏的 OpenAI 未在首批名单中。

架构核心

五项原则:策略事前可验证、执行机制独立于智能体、控制点设在模型通道上、权限与推理透明度挂钩、责任分担模型。

英伟达类比90年代浏览器沙箱建立互联网信任层的历程,认为智能体的"漂移"无法靠模型训练彻底消除,须靠硬件与基础设施层的信任机制。Vera Rubin POD 每个计算托盘配 BlueField-4,现有用户一次软件更新即可开启全流程防护。

所属事件:NVIDIA 联合百家伙伴发布 Open Agent Safety 平台(31 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →