M3 Ultra 本地跑大模型,速度仍难胜任编码

有作者在配备 512GB 内存的 M3 Ultra 上实测 GLM5.2 和 Qwen 3.8 27B:GLM5.2 速度约 16 t/s,适合后台任务;Qwen 3.8 27B 表现也受限。作者认为本地推理适合整理媒体库、Obsidian 笔记、记账等场景,但 16 t/s 无法满足每天 12 小时以上的编码需求,评论区也补充了类似观点。

2026-08-26 ~ 2026-08-26 · 2 条相关