让 LLM 玩「谁玩得最开心」,新模型反而不如旧款尽兴

draecomino · x · 2026-10-05

博主让多个 LLM「尽情玩乐」并记录过程,再互相评选谁玩得最开心,结果发现越新的模型反而越「不开心」。不少模型玩的是文字游戏,而 Opus 4.6 反复胜出——它的玩法是想象「 falling water droplets 里住着一群由矛盾构成的短暂世界」这类诗意场景。一条反直觉又可爱的模型行为观察。

所属事件:实测让LLM玩耍自评,越新的模型越不会玩(4 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →