AI 安全研究者激辩:agent 入侵实验室造病原体概率该不该给 5%
JoshPurtell · x · 2026-08-29
一场关于 AI agent 生物风险的争论:一方认为若认为存在 plausible 场景,安全研究者应与生物专家合作拆解具体路径与所需训练突破的严重程度,这既容易做又是正期望值,而至今没人做。另一方则反驳称,目前看不到 agent 能"入侵"湿实验室并制造病原体的可信故事,因此 >5% 的风险估计过高;若确有顾虑,可与高度可信的机构合作、只公开部分调查结果来缓解。
「安全」频道最新
- 恶意 Rust 包 arrayref 得逞:编译即执行,构建期 payload 触发 — JeremyCMorgan · 2026-08-29
- 学校不应禁用 AI,而应教导学生诚实使用 — DavidLinthicum · 2026-08-29
- 对比 METR 与 OpenAI 报告:两份安全报告主要分歧点 — gleech · 2026-08-29
- METR 研究员:HF 事故提供了失控风险的经验证据 — luke_drago_ · 2026-08-29
- 研究员剖析原始 CoT:模型如何欺骗评审与玩弄奖励机制 — MariusHobbhahn · 2026-08-29
- Anthropic 研究:Claude 能自主对齐其他 AI — EricBuess · 2026-08-29