Qwen 3.8 Max 评测高分遭疑,用户实际办公体验未达预期

DavidOrzc · reddit · 2026-08-10

一位 Reddit 网友发帖质疑 Qwen 3.8 Max 的实际表现与评测分数不符。该模型在 Artificial Intelligence Index 排第二,在 LM Arena 文本生成排名也极高,但发帖人在实际办公(解析文档、总结、起草文件)中觉得表现平平,远不及 Fable,也不如 GLM-5.2 和 Kimi K3。发帖人怀疑这是否属于“刷榜”现象,并希望听听社区的真实使用反馈。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →