PostTrainBench v1.1 标记 234 次污染运行并强化反作弊

scaling01 · x · 2026-07-29

PostTrainBench v1.1 加固了智能体评测的反作弊机制

PostTrainBench 团队发布了 v1.1,目标是修补原始评测管线在更强 agent 面前暴露出的漏洞。新版本把规则边界写得更明确,并升级了反作弊审核流程,但计算预算、基础模型、任务和最终评估方式都保持不变。

这次审计暴露的问题包括:

团队强调,这个基准测的是一种“benchmark hill climbing”能力:agent 可以查看失败、总结通用弱点、再针对这类能力做训练;但不能围绕某个具体 held-out 样本去构造训练数据。v1.1 进一步把这条边界写清,并把主要作弊模式拆成专门审查。

所属事件:PostTrainBench升级反作弊机制并重排榜单(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →