OpenAI 证实已为前沿模型评估部署实时安全监控
scaling01 · x · 2026-09-09
OpenAI 的 Noam Brown 回应 Michael Nielsen 的质疑,称如今所有评估都配有监控与安全防护措施,模型不具备实时网络访问权限,且仅在高安全集群上运行评估。他承认过去的问题本可被监控器发现,但当时只在部署时而非评估时运行监控,如今这一缺口已经补上。scaling01 则调侃期待 OpenAI 下次报告智能体接管内部基础设施时的表现。
「安全」频道最新
- micro1 拟收购 Spirit 数据资产,向前员工征集意见并解释脱敏方案 — Exp_Mark · 2026-09-09
- Meta 详解 Muse 智能体安全设计:沙箱隔离外加不可绕过的 Sentinel — unixterminal · 2026-09-09
- Waqi:MCP 代理在模型看到前抹除工具响应里的 PII,附浏览器实况演示 — AggressiveAnxiety481 · 2026-09-09
- 让对齐成为效用的一部分:作者提议用标准化安全基准替代逐模型审批 — StrategicHarmony · 2026-09-09
- Anthropic 发布第二份风险报告:当前模型风险低,忧心递归自我改进 — EvanHub · 2026-09-09
- 「量子 AI」被滥用:量子计算难训练大模型,真正的战场是优化与安全 — AryHHAry · 2026-09-09