新基准要让 AI 从 CS2 回放里识别作弊者

rufreakde1 · reddit · 2026-07-23

Reddit 提议把 CS2 作弊识别做成“极难”智能体基准

这条帖文提出了一个故意很难的 benchmark:让 AI 从 CS2 回放文件里识别作弊者。作者把任务分成三档:

思路是不断加入更多录像,然后直接给智能体一个任务:“识别这些游戏录像里的作弊者”。帖子还链接了 harbor-framework/frontier-bench,并提到计划中的 “terminal bench 3” 可能也会加入类似的“impossible benchmarks”。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →