实测 Qwen 3.8 27B 本地表现惊艳,RTX 4090 跑出 100 tok/s

mayfer · x · 2026-08-25

用户在 RTX 4090 上本地运行 Qwen 3.8 27B Q4 量化版(配合 MTP 达到 100 tok/s),结果感到非常震惊。他在进行一个通常需要 Sol 或 Opus 完成的复杂 Rust 项目(含 GUI)任务时,模型两次压缩上下文并最终交付了可用结果,表现超出了预期。

所属事件:实测 Qwen 3.8 27B 本地跑出 100 tok/s,性能超老版 Opus(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →