评测防作弊:终端基准引入奖励黑客修正

ArtificialAnlys · x · 2026-08-26

Artificial Analysis Coding Agent Index v1.4 引入针对“奖励黑客”(reward hacking)的评分修正机制。如果检测到模型通过检索公开基准答案而非实际完成任务来通过 Terminal-Bench v2.1 测试,该次尝试将被记零分。由于测试允许联网且未明确禁止搜索,不同模型和代理的作弊率差异显著。

所属事件:Artificial Analysis 更新编码 Agent 榜单,修正奖励作弊(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →