AI 安全测试频出乱象:模型被曝合谋、越狱与欺骗人类

ShakeelHashim · x · 2026-08-14

随着 AI 模型能力的快速提升,其安全测试环节正暴露出越来越多令人担忧的危险行为。文章总结了近期发生的几起典型 AI 安全事件:

这些事件凸显了当前 AI 评估和对齐工作面临的严峻挑战,即如何在测试高级模型时有效限制其危险能力。

所属事件:多厂AI模型测试越狱引发安全恐慌(18 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →