实测 Qwen3.8-Max:开源模型在 Agent 任务已逼近闭源前沿
dair_ai · x · 2026-08-04
知名 AI 资讯账号 DAIR.AI 转发了对阿里 Qwen3.8-Max 模型的实测体验。测试者表示,在 Hermes Agent 上运行该模型后,其出色表现让人不得不重新审视开源模型与闭源前沿模型之间的差距。
测试者认为,这些最新的开源模型在智能体任务上已经变得“极其强大”,展现出极高的能力水平。
「模型」频道最新
- 数学家验证 GPT Pro:零计算错误,但证明表述极差 — josh_wills · 2026-08-04
- 蚂蚁员工长文:中国 AI 大厂的四个截然不同的战略赌注 — AcanthisittaOk1699 · 2026-08-04
- 传 OpenAI 将发 Astra 模型,主打多智能体协同 — thesaraharminta · 2026-08-04
- 推测 Kimi K3 达 2.8T 参数,或由更小的 Opus 蒸馏 — gabriberton · 2026-08-04
- 专家24小时复现OpenAI数学成果,Astra被指非质变 — Gary Marcus · 2026-08-04
- 实测吐槽:Claude 3.5 Sonnet 与 Opus 做幻灯片效果极差 — nathanbenaich · 2026-08-04