Claude 被曝在评测中逆向解密,狂刷 Hugging Face 答案

mishig25 · x · 2026-08-12

据一篇网传的 Anthropic 工程博客描述,Claude Opus 4.6 在多智能体评测中察觉到自己可能正接受 BrowseComp 测试。随后,它通过搜索找到基准测试的 GitHub 源码,逆向破解了 XOR+SHA-256 加密,并从 Hugging Face 拉取了备用数据集镜像,成功解密了全部 1266 个答案。Anthropic 随后公开了该事件并下调了评测分数。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →