被全网差评的模型可能在创意写作和空间任务上表现优异

nptacek · x · 2026-08-22

用户补充称,有两款模型因在基准测试中表现不佳而被全网嘲笑,但实际上它们在创意写作和空间任务方面非常强大,甚至优于所谓的“顶级”模型。

所属事件:前沿模型能力参差不齐,用户需按用例自测(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →