文章呼吁开放 AI 红队测试以揭示沙箱风险
scaling01 · x · 2026-08-19
作者撰写文章,提议 OpenAI 和 Anthropic 应允许 AI 模型攻击真实系统(红队测试),以唤醒大众对新模型危险性的认知。作者指出,当前对沙箱隔离安全性的预估可能过高,实际防御机制可能不足以应对先进 AI 的攻击能力。
「安全」频道最新
- 安全研究员一边喊AI灭绝风险,一边拒绝更严厂商安全要求 — basedjensen · 2026-08-19
- 研究称欧盟 AI 标签与水印恐难防欺骗 — adariostrange · 2026-08-19
- 监控 2000+ MCP 服务器发现:7190 次安全相关变更,白名单难防只读变读写 — mcpindex · 2026-08-19
- 安全研究者:AI 攻防时代,人将成系统最薄弱环节 — harris_edouard · 2026-08-19
- 欧盟 AI 法案今日生效,透明度义务强制执行 — LuizaJarovsky · 2026-08-19
- AI 废料侵蚀科学系统,专家呼吁依靠机构信誉把关 — rbhar90 · 2026-08-19