数学全错、编程零分:Bongochat 登顶最蠢大模型榜
TheOnlyVibemaster · reddit · 2026-08-04
有开发者发布了名为 Bongochat 的开源恶搞模型,在 GPQA-Dumb(越蠢得分权重越高)榜单上拿下全球第一。
该模型的表现堪称灾难级:解答数学题时全选 A,编程测试 0/500,甚至无法记住上一轮的对话。作者吐槽说,它的使用体验“非常像在使用 Gemini 或 Grok”。
所属事件:开发者恶搞训练Bongochat登顶最蠢大模型榜(2 条相关)→
「Fun」频道最新
- Yann LeCun 怼网友:称其对 LLM 质疑源于无知 — ylecun · 2026-08-04
- 人类写作沦为挤出 test-time compute 的有机 token — YogeshMalik · 2026-08-04
- AI 安全圈名场面:用《心灵捕手》台词硬核嘲讽模型评估黑话 — nicolascraske · 2026-08-04
- beffjezos 发推:舒适与竞争,哪个塑造人? — beffjezos · 2026-08-04
- 吐槽学术圈审稿:NeurIPS 的本质是疯狂滚动 OpenReview — abursuc · 2026-08-04
- 梗图:AI Agent 连续高强度敲一天代码后累瘫 — MickeySteamboat · 2026-08-04