发起「zitronbench」挑战:谁能难倒批评 LLM 的 Ed Zitron
iruletheworldmo · x · 2026-09-06
X 用户公开挑战 AI 批评者 Ed Zitron:请他提出一个当前 SOTA 大模型会做错的任务,只要有人在评论区用「纯 LLM」一次性完成并附证明即可。这场挑战被命名为 zitronbench,本质是 AI 圈对「LLM 连简单任务都做不好」这一批评立场的公开对赌。
「Fun」频道最新
- 「深渊来客」:把 agent 安全焦虑写成文明末日对话 — eigenron · 2026-09-07
- 用 AI 伪造一套完整 UX 作品集,连项目指标都煞有介事 — AIandDesign · 2026-09-07
- Google Astra 挑战经典测试:「鹈鹕骑自行车」生成引关注 — Recoil42 · 2026-09-07
- Mike Frank 追更 AI 打游戏王:曾把卡牌世界冠军当 AGI 试金石 — MikePFrank · 2026-09-07
- Astra 首局即胜《游戏王 Master Duel》,仅失 100/8000 生命值 — MikePFrank · 2026-09-07
- 让 Astra 现场表演 Rickroll,或成新一代「自行车鹈鹕」基准 — dotey · 2026-09-07