质疑 Qwen3.8 27B 比 Opus 4.5 强,指其为刷榜模型

scaling01 · x · 2026-08-19

作者批评认为 Qwen3.8 27B 能力媲美 Opus 4.5 的观点是妄想,指出这是每年都会出现的针对“刷榜模型”(benchmaxxed model)的无意义争论。作者认为虽然声称过于夸张,但相比 o1/o3-mini 等,Qwen3.8 在某些智能体任务上可能更具实用性。

所属事件:Qwen3.8 27B 堪比 Opus 4.5 之争:本地模型落后前沿约 1.5-2 年(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →