David Holz 实测:让 LLM「找乐子」,新版模型反而玩得不如旧版尽兴

DavidSHolz · x · 2026-10-05

Midjourney 创始人 David Holz 分享了一个趣味实验:让多个 LLM 自由地「玩得开心」,记录过程并互评谁玩得最尽兴。结果显示较新的模型反而「玩得没那么开心」。不少模型玩文字游戏,而 Opus 4.6 屡屡胜出——它想象出「住在坠落水滴中、由矛盾构成的短暂世界」。Holz 补充称,Mistral 想象了饼干抢劫案,OpenAI 顶级模型则画出了 ASCII 小岛并加以探索,这些回答像一扇窥见模型「内心世界」的窗。

所属事件:实测让LLM玩耍自评,越新的模型越不会玩(4 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →