62 人盲测 48 个 LLM 笑话:幽默感真的在变强
paraschopra · x · 2026-10-06
Paras Chopra 做了一项实验,检验前沿大模型是否越来越会讲笑话:62 名受访者对来自六个模型的 48 个笑话进行评分。
结果显示模型幽默感确实在进步,Astra 拿下第一,获得超过 50% 的「会心一笑/大笑」反应。作者认为这检验了数学、代码等可验证领域的能力进步,能否迁移到「幽默」这类难以验证、依赖品味的软性能力。
完整方法与结果发布在其 Substack 文章中。
所属事件:62人盲测48个LLM笑话 大模型幽默感持续进步(2 条相关)→
「Fun」频道最新
- 马斯克谈人类未来:应保持乐观并为之奋斗 — XFreeze · 2026-10-06
- Claude Opus 5.5 一口气做出完整城市建造游戏,成本仅 5 美元月费额度 — isnit0 · 2026-10-06
- 15 小时用 Claude Opus 5.5 把艾尔登法环角色搬进 Minecraft — PuzzleheadedView6669 · 2026-10-06
- 给 Claude 18 小时,独立复刻出 Windows XP「Macrohard」 — FinanceYF5 · 2026-10-06
- Opus 5.5 十分钟用 TypeScript 写出雨火烟雾齐动的像素动画场景 — iamfakhrealam · 2026-10-06
- DINOv3+SAM 本地实时清点手术器械,14 秒揪出缺失器械 — MaziyarPanahi · 2026-10-06