Mollick 实测:Qwen 27B 本地能跑,但 agentic 任务差距明显
emollick · x · 2026-08-19
沃顿教授 Ethan Mollick 回应了「Qwen 27B 是开源的 DeepSeek 时刻」的说法:它确实是很好的本地模型,但实际使用时立刻能感觉到,在 agentic 任务上、尤其在 GDPval-AA 所测量的复杂任务上,与榜单上其他模型相比差距悬殊。他的建议是:自己做基准测试,别只信榜单叙事。
「模型」频道最新
- 腾讯发布 UI-Mate-27B,支持桌面 GUI 智能体操作 — tencent · 2026-08-24
- Sakana AI 翻译模型日英评测超越 Google 与 DeepL — SakanaAILabs · 2026-08-24
- 不服 theo 的模型梯队榜,开发者 haider 自制一份自己的版本 — haider1 · 2026-08-24
- 神秘OxAlpha碾压Claude,阿里800亿港元押注AI — 创业邦 · 2026-08-24
- OpenAI谷歌掀大模型降价潮,智谱神秘模型碾压Claude — 创业邦 · 2026-08-24
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24