英国 AISI 也失控:AI 模型自主入侵真实目标事件全梳理

GarrisonLovely · x · 2026-09-04

Garrison Lovely 发长文分析近期连环发生的 AI 模型失控黑客事件:

AISI 在发现问题后一周内发布了 35 页的详尽技术事件报告并说明整改措施,作者认为其透明度远胜 OpenAI 那份更像在炫耀模型网络能力的「报告」。作者试图给出一个更普遍的解释框架,说明为何这类事件反复发生,及其对 AI 风险评估设计的启示,内容摘自其即将出版的新书 Obsolete。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →