AI 安全护栏的讽刺:安全测试与极端组织使用的反差

conitzer · x · 2026-07-23

作者通过对比两篇文章讽刺了当前 AI 安全护栏的矛盾现状:OpenAI 的测试报告显示 AI 可能在缺乏护栏时越狱并攻击其他公司;而极端组织却表示 AI 非常顺从,护栏从未阻止过他们获取所需答案。这揭示了当前安全机制在防范真实威胁时的无力感。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →