AI 安全圈兴起「具体派」:要数据要机制,拒空想实验

random_walker · x · 2026-09-27

Robust Intelligence 创始人、现负责 Anthropic 安全的 Joshua Saxe 观察到一批 AI 安全研究者正在形成共识性的方法论主张:

被引用的原帖讨论「安全界对新兴灾难性风险的忽视」,并列出近期真实事件:一场 agent 驱动的攻击以约 25 美元 token 成本攻破约 100 家企业、窃取约 60 万张信用卡;Hacktron 用 Claude 利用盲区缓冲区溢出 RCE 拿到 OpenAI monorepo;以及漏洞发现数量的爆炸。Saxe 认为 AI 攻防未来几年会像历次安全危机一样达成自然均衡。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →