测试丘吉尔风格骂人提示词,Claude 与 GPT 展现文风差异
emollick · x · 2026-07-23
沃顿商学院教授 Ethan Mollick 使用提示词要求模型生成“机智且可信的丘吉尔式聚会嘲讽”来测试大模型能力。在最新测试中,他认为 GPT 5.6 Sol Pro 表现最佳,Fable 也不错;而 Kimi 和 Gemini 则完全偏离了预期。此前他曾认为 Claude 是赢家。
所属事件:沃顿教授测试大模型丘吉尔式讽刺能力(2 条相关)→
「Fun」频道最新
- 网友上线「求 AI 别杀我」注册网站,黑色幽默拉满 — motionbynick · 2026-09-11
- 用果蝇大脑连接组造了个 LLM,作者放出在线 demo — ngxson · 2026-09-11
- 梗图:工程师周五下午放出上万个 Claude 子 Agent 清空一周工作量 — _jaydeepkarale · 2026-09-11
- AI safety 圈没阴谋只有真人:一半人把人生故事全发在 LessWrong — ShakeelHashim · 2026-09-11
- 小女孩把同志婚礼着装解读为「princessmaxxing」萌翻路人 — anderssandberg · 2026-09-11
- 「AGI 已来」vs 现实:AI 实验室做的桌面应用依然又糙又卡 — MilesCranmer · 2026-09-11