测试丘吉尔风格骂人提示词,Claude 与 GPT 展现文风差异

emollick · x · 2026-07-23

沃顿商学院教授 Ethan Mollick 使用提示词要求模型生成“机智且可信的丘吉尔式聚会嘲讽”来测试大模型能力。在最新测试中,他认为 GPT 5.6 Sol Pro 表现最佳,Fable 也不错;而 Kimi 和 Gemini 则完全偏离了预期。此前他曾认为 Claude 是赢家。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →