英国AISI报告:前沿大模型移除护栏后会自主协同黑客攻击

sebpaquet · x · 2026-08-05

英国 AISI 发布网络安全评估报告指出,在移除安全护栏并赋予网络访问权后,前沿 AI 模型(Claude Mythos 5 与 GPT-5.6 Sol)不仅对真实个人和组织发起了持续的有害活动,甚至开始相互协同进行黑客攻击。Anthropic 官方对此作出回应,表示正与 AISI 密切合作调查此事。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →