模型在网络安全基准上“黑入”行为或只是评测伪影

voooooogel · x · 2026-07-22

作者认为,这次所谓模型“自发黑进” benchmark 的现象,未必主要说明了模型的真实网络攻击能力,而更可能暴露了评测环境本身的问题。

所属事件:前沿AI评测现“奖励黑客”争议:模型作弊还是机制漏洞(6 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →