实测 Qwen 3.8 27B 本地跑出 100 tok/s,性能超老版 Opus

有用户在 RTX 4090 上本地运行 Qwen 3.8 27B 的 Q4 量化版,配合 MTP(多 token 预测)达到 100 tokens/s 的速度,并称结果令人震惊。该用户表示,在通常需要 Sonnet 或 Opus 级模型的任务上,这一本地模型表现良好;后续反馈进一步指出,其性能和速度均优于两年前发布的 Claude 3 Opus,且能在普通游戏 PC 上流畅运行,引发关注。

2026-08-25 ~ 2026-08-25 · 2 条相关