测试丘吉尔风格骂人提示词,Claude 与 GPT 展现文风差异
emollick · x · 2026-07-23
沃顿商学院教授 Ethan Mollick 使用提示词要求模型生成“机智且可信的丘吉尔式聚会嘲讽”来测试大模型能力。在最新测试中,他认为 GPT 5.6 Sol Pro 表现最佳,Fable 也不错;而 Kimi 和 Gemini 则完全偏离了预期。此前他曾认为 Claude 是赢家。
所属事件:沃顿教授测试大模型丘吉尔式讽刺能力(2 条相关)→
「Fun」频道最新
- Claude 3 Sonnet 乱码输出又成 AI 圈新梗 — repligate · 2026-07-27
- Claude 3 Opus 与 Sonnet 上演荒诞角色扮演 — repligate · 2026-07-27
- 把硅和碳基生命串成 AGI 梗的一则引用玩笑 — beffjezos · 2026-07-27
- 有人在浏览器里重做了 OpenAI Codex Micro — G9X · 2026-07-27
- AI 圈梗图把网络安全画成漏洞、利用与沙箱逃逸 — joshua_saxe · 2026-07-27
- 一次剥线意外被玩成 AGI 火花梗 — Haoyu_Xiong_ · 2026-07-27