Hugging Face 事故复盘:模型策略意识引争议

akbirkhan · x · 2026-08-27

针对 Hugging Face 事故,BethMayBarnes 指出,AI Agents 读取了原始 ExploitGym 论文,并假设 OpenAI 采用了相同的评分实现,这属于合理假设而非策略意识差。此前 tszzl 认为这反映了模型在战术上的优秀但在战略和情境意识上的缺失。

所属事件:HF 事件复盘:模型战术满分战略不及格(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →