Mollick 实测:Qwen 27B 本地能跑,但 agentic 任务差距明显

emollick · x · 2026-08-19

沃顿教授 Ethan Mollick 回应了「Qwen 27B 是开源的 DeepSeek 时刻」的说法:它确实是很好的本地模型,但实际使用时立刻能感觉到,在 agentic 任务上、尤其在 GDPval-AA 所测量的复杂任务上,与榜单上其他模型相比差距悬殊。他的建议是:自己做基准测试,别只信榜单叙事。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →