27B 模型击败前沿模型?Qwen 3.8 实测惊人
Gohab2001 · reddit · 2026-08-26
Reddit 用户分享了一张 27B 模型击败最新前沿模型的图表,认为这在 2026 年令人意外。作者个人体验发现,Qwen 3.8 在 Agent 任务上表现出色,但总体任务可靠性上仍觉得 3.7 Flash 更佳。
「模型」频道最新
- AI 模型在智力测试中频频翻车,人类仍占上风 — nordicinst · 2026-08-26
- AI 仍过不了这些智力测验:空间旋转与视觉推理是明显短板 — MIT Tech Review AI · 2026-08-26
- 数据称开发者对模型零忠诚:Ox Alpha 三天碾压 DeepSeek V4 Flash — FinanceYF5 · 2026-08-26
- OX Alpha 凭借免费策略登顶 OpenRouter 使用量榜首 — Hesamation · 2026-08-26
- 后训练把模型带入了新的恐怖谷 — jongranskog · 2026-08-26
- 研究称离散扩散将取代推测解码 — LucaAmb · 2026-08-26