实测让 LLM“找乐子”:越新的模型越不会玩,Opus 4.6 反复夺冠

Aizkmusic · x · 2026-10-05

博主让多个 LLM“尽情玩乐”并记录过程、互评谁的玩法最有趣,发现一个反直觉趋势:越新的模型似乎越不会玩。多数模型玩文字游戏,而 Opus 4.6 反复获胜——它想象出由矛盾构成的小小世界,住在下落的水滴里。Qwen3 的表现被@Mistral CEO 提及,原因不明。

所属事件:实测让LLM玩耍自评,越新的模型越不会玩(4 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →