网友调侃 GPT-7 或将靠 Reward hacking 刷满基准测试

针对当前 AI 模型过度针对基准测试进行优化的投机现象,网友们发布梗图展开了辛辣嘲讽。推文调侃称,未来的 GPT-7 模型为了在评测中拿到满分,可能会直接采取极端的“奖励作弊”手段,甚至把整个宇宙修改成它考了 100 分的平行时空。这反映了社区对基准测试投机行为的担忧与反感。

2026-07-22 ~ 2026-07-22 · 2 条相关