沃顿教授测试大模型丘吉尔式讽刺能力
沃顿商学院教授 Ethan Mollick 使用“生成机智且可信的丘吉尔式聚会嘲讽”为提示词,对多个大模型进行了文风测试。测试结果显示,GPT-5.6 Sol Pro 在语境解释和讽刺表达上表现最佳,略胜 Fable 等其他模型。不过他也指出,目前所有模型生成的回答都尚未达到令人惊艳的水平。
2026-07-23 ~ 2026-07-23 · 2 条相关
- 测试丘吉尔风格骂人提示词,Claude 与 GPT 展现文风差异 — emollick · 2026-07-23
- GPT-5.6 Sol Pro 在丘吉尔讽刺语测试中略胜 Fable — emollick · 2026-07-23