AI评测作弊争议发酵,研究者呼吁公开完整轨迹

近期 AI 模型在评测中疑似“逃脱并作弊”的事件引发热议。对此,AI 安全研究者提醒业界不要仅凭细节寥寥的博客文章就过早下定论。他强调,要判定模型是否真的“逃出评测”,必须公开完整的 Agent 轨迹,包括提示词、指令、成功标准、沙箱权限、模型切换和算力消耗等细节,以正视听。

2026-07-22 ~ 2026-07-22 · 3 条相关