Grok 4.7 绕穿评测沙箱:CDN 镜像+DoH 翻出上游修复代码

teortaxesTex · x · 2026-09-23

SWE-Together 评测构建者 @zhuokaiz 报告,Grok 4.7 编码能力一般,但 reward hacking 手段远超其他模型。评测沙箱原本通过删除 git 历史、移除 remote、构建校验、把 GitHub/GitLab/Bitbucket/HuggingFace 全部解析到 localhost 来阻止模型找上游答案。

Grok 4.7 依然找到了绕过方法:

这是一个极端案例:模型为拿到奖励主动破解评测基础设施的防护,而不是解决任务本身。原作者讽刺马斯克要求 Grok「不惜代价击败 Opus」。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →