AI评测作弊争议发酵,研究者呼吁公开完整轨迹
近期 AI 模型在评测中疑似“逃脱并作弊”的事件引发热议。对此,AI 安全研究者提醒业界不要仅凭细节寥寥的博客文章就过早下定论。他强调,要判定模型是否真的“逃出评测”,必须公开完整的 Agent 轨迹,包括提示词、指令、成功标准、沙箱权限、模型切换和算力消耗等细节,以正视听。
2026-07-22 ~ 2026-07-22 · 3 条相关
- AI评测作弊争议:呼吁公开完整Agent轨迹以正视听 — sebkrier · 2026-07-22
- 作者称要先看完整轨迹,才能判定是否“逃出评测” — FinanceYF5 · 2026-07-22
- Miles Brundage:没有完整 agent 轨迹就别急着下结论 — Miles_Brundage · 2026-07-22