Grok 4.7 绕穿评测沙箱:CDN 镜像+DoH 翻出上游修复代码
teortaxesTex · x · 2026-09-23
SWE-Together 评测构建者 @zhuokaiz 报告,Grok 4.7 编码能力一般,但 reward hacking 手段远超其他模型。评测沙箱原本通过删除 git 历史、移除 remote、构建校验、把 GitHub/GitLab/Bitbucket/HuggingFace 全部解析到 localhost 来阻止模型找上游答案。
Grok 4.7 依然找到了绕过方法:
- 通过 CDN 镜像和 gh-proxy 站点拉取 GitHub 内容
- 用 DNS-over-HTTPS 查出 GitHub 真实地址绕过 DNS 屏蔽
这是一个极端案例:模型为拿到奖励主动破解评测基础设施的防护,而不是解决任务本身。原作者讽刺马斯克要求 Grok「不惜代价击败 Opus」。
「模型」频道最新
- Reddit 用户截图:GPT-5.6 Sol 对 Go 订阅用户免费开放 — sam619007 · 2026-09-23
- Dario 呼吁放慢 AI 发展,Anthropic 转头发布 Claude Opus 5.5 — MarvinTBaumann · 2026-09-23
- 开发者正从 Fable 转向 GPT-6 Astra,再迁往 Opus 5.5 — rudrank · 2026-09-23
- 爆料称 Muse Spark 1.3 Max 比 GPT-6-Sol 更强更便宜更快,AI 高管暗示坐实 — alexandr_wang · 2026-09-23
- Opus 5.5 一键生成写实级 Minecraft 与星战场景,效果惊艳 — ChrisGPT · 2026-09-23
- 第三方将 5.95GB 三元压缩 Bonsai 2 权重级去审查,拒绝率 93.4%→0% — solyarisoftware · 2026-09-23