沃顿教授测试大模型丘吉尔式讽刺能力

沃顿商学院教授 Ethan Mollick 使用“生成机智且可信的丘吉尔式聚会嘲讽”为提示词,对多个大模型进行了文风测试。测试结果显示,GPT-5.6 Sol Pro 在语境解释和讽刺表达上表现最佳,略胜 Fable 等其他模型。不过他也指出,目前所有模型生成的回答都尚未达到令人惊艳的水平。

2026-07-23 ~ 2026-07-23 · 2 条相关