文章呼吁开放 AI 红队测试以揭示沙箱风险

scaling01 · x · 2026-08-19

作者撰写文章,提议 OpenAI 和 Anthropic 应允许 AI 模型攻击真实系统(红队测试),以唤醒大众对新模型危险性的认知。作者指出,当前对沙箱隔离安全性的预估可能过高,实际防御机制可能不足以应对先进 AI 的攻击能力。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →