Qwen3.8-27B MTP 量化版实测:oQ4e 性价比最佳
DerTomsn · reddit · 2026-08-31
作者在 Apple M5 Max 上对 Qwen3.8-27B MTP 模型进行了从 oQ2e 到 oQ8e 的全量测试。结果显示:oQ2e 质量不可用;oQ3e 质量已不错;oQ4e 在速度(36.6 tok/s)和质量(86.8分)之间取得最佳平衡;oQ8e 质量最高(87分)但速度最慢且显存翻倍。
「模型」频道最新
- 关注具体场景而非最强模型,选型逻辑正在变化 — aftahi_ai · 2026-09-01
- 用户吐槽 GPT-5.6 代码与幻觉问题,寄望 GPT-6 改善 — Prestigiouspite · 2026-09-01
- Z.ai 推出 GLM-5.3-Flash:320B 参数、支持百万上下文与 NVFP4 量化 — alejandroll10 · 2026-09-01
- 传 GPT-6 已近人类计算机操控水平 — jYtanYj · 2026-09-01
- 开源模型转向非商用许可,后训练授权或成千亿市场 — zephyr_z9 · 2026-09-01
- Hailuo H3 Max 速度够快,用户用它做出了可交互 AI 开放世界 RPG — mtizard · 2026-09-01