黄仁勋谈 AI 安全:围栏隔离加实时监控,安全与进步不是二选一
XFreeze · x · 2026-09-30
黄仁勋系统阐述了 NVIDIA 的 AI 安全观:训练阶段环境相对可控,但评测测试时必须对模型与 agentic 系统做严格围栏(containment),且绝不能假设围栏一定有效,需在沙箱之外的独立芯片上实时监控,越界或违反策略即逐级上报;部署后沿用同一套「围栏+监控」逻辑,如同对待新员工——只给应有的权限并持续监督。为此 NVIDIA 推出两项技术:OpenShell,一个 agent 围栏系统,类似「agent 的浏览器」,把 agent 与计算机其余部分隔离并最小化权限;BlueField 芯片,作为独立监控层全天候观察 agent 行为。他强调「安全与推进技术是一回事」,认为能力与安全此消彼长是伪命题。
「Infra」频道最新
- SGLang 把 Qwen3.8-27B 变决策模型,百毫秒内通关宝可梦火红 — zhaoran_wang · 2026-09-30
- Agent 时代 CPU 成新瓶颈:Vera 单独部署预示 CPU:GPU 比例将上调 — AccBalanced · 2026-09-30
- AT&T CEO 放话:SpaceX 手机卫星策略「行不通」 — RachelVT42 · 2026-09-30
- ModelScope CLI 迁移至 modelscope-hub 包,官方未发文档说明 — pilkyton · 2026-09-30
- Rowmax-H15:B200 上注意力前向最高提速 25.8% — illinois · 2026-09-30
- AWS Bedrock 上线印度境内 Claude 推理:Opus 5 等三模型数据不出境 — AWS ML Blog · 2026-09-30