Qwen 3.8 27B 对比 3.6:质量升 8%,耗时却长 5 倍
DerTomsn · reddit · 2026-09-04
用户在 oMLX 上对比 Qwen 3.8 27B 与 Qwen 3.6 27B:质量分从 81.1 升至 87.7(+8%),但速度从 35 降到 29 tok/s(-16%),运行时间从 8 分 51 秒暴增到 44 分 39 秒(5 倍),输出 token 从 18K 涨到 78K。结论是新模型明显更聪明,但代价是 token 消耗与时间大幅上升。完整多硬件、多量化对比见 llm-bench.io。
「模型」频道最新
- 2026 年还信 benchmark?AI 圈大佬公开嘲讽跑分崇拜 — vasuman · 2026-09-04
- 真正的交互性测试:能否只靠和 LLM 对话学会一门新语言 — akbirthko · 2026-09-04
- 753B 模型思考、4B 模型执笔:潜空间协作实现 20 倍提速 — burny_tech · 2026-09-04
- OpenAI 员工实锤:Anthropic 换 tokenizer 让 Opus 4.7 隐性涨价约 30% — stevenheidel · 2026-09-04
- 按 token 计价已失真:Astra 每任务成本反低于便宜 13 倍的 Flash — stevenheidel · 2026-09-04
- 传 GPT-6 Astra 心算竞赛级数学,隐式推理能力大幅跃升 — nabeelqu · 2026-09-04