LLM 幽默品味实测:偏爱荒诞和 roast,Gemini 判断最稳定
Gold-Bat-3225 · reddit · 2026-09-16
laugh.so 发布了一份模型幽默品味研究报告:
- 各 LLM 的笑点判断有约 3/4 的一致性,但个体差异大,区间在 54.9% 到 92% 之间
- Gemini 是最稳定的「幽默评委」,不过所有模型的一致性都低于人类
- 几乎所有模型都强烈偏好荒诞幽默(absurd humor)和 roast 类笑话格式
完整分析见报告原文。
「Fun」频道最新
- 用 Qwen 27B 每秒 2000 token 生成整个互联网,做出零联网幻觉浏览器 — sierracatalina · 2026-09-16
- AI 老 researcher 吐槽:Astra 跟子 agent 说我「要结果不要客套」 — moyix · 2026-09-16
- 电容自爆失踪:网友接电瞬间听到巨响外加一股青烟 — _Stocko_ · 2026-09-16
- 网友调侃 OpenAI 算力紧张:想多用 10 倍也没门 — CtrlAltDwayne · 2026-09-16
- 「这个 e 比别的字母更躁」:模型行为又成圈内梗 — AI_Andrew · 2026-09-16
- 同时穿 e/acc T恤和 LessWrong 卫帽的精分名场面 — eigenron · 2026-09-16