安全研究员嘲讽「未来AI失控无法检测」论调
nptacek · x · 2026-09-01
安全研究者 nptacek 转发 ZackKorman 的讽刺:声称「未来 AI 会聪明到我们无法检测 agent 失控」的人,往往自己从未做过检测相关工作。这是 AI 安全圈内外围绕可检测性问题长期互相嘲讽的一个缩影。
「Fun」频道最新
- OpenAI Swarm 智能体产出大量内部戏剧 — moyix · 2026-09-01
- Melanie Mitchell 年度词汇提名:拟人化 — MelMitchell1 · 2026-09-01
- 「我不学习,我直接下载」:一句吐槽道尽学习焦虑 — moonsandhues · 2026-09-01
- “TPOT 思想家”多是寻求关注的产物 — BasedRaddka · 2026-09-01
- 「别再空谈AI意识,去造数字生命」引发争论 — nptacek · 2026-09-01
- 用户评价 Sequoia Sutton 采访未达预期 — generativist · 2026-09-01