本地 27B 模型实测:Mac 上跑通 Tool Loop
conifer_v11 · reddit · 2026-08-27
作者分享了在本地 Mac 上运行 Qwen 2.5 27B (q4km 量化版) 的经验,占用约 16-17GB 显存,无需将代码发送到云端。主要观点包括:
- 本地化优势:grep、代码探索和提交信息处理无需离开本地环境。
- 性能瓶颈:指出 KV 缓存而非权重是瓶颈,建议使用 --kv-cache-dtype fp8 或量化 KV (q80) 来支持更长上下文(如 128k)。
- 稳定性需求:强调需要具名 ID 以防止模型在背后被廉价替换,主张在工具循环中尽量使用本地算力,仅在必要时通过 OpenRouter 跳转到云端。
「编程与Agent」频道最新
- ComfyUI 桌面模型管理器:自动整理与更新检测 — apb91781 · 2026-08-27
- 发现宝藏:用 Claude Code 构建 VR 世界时的绝佳资产库 Sketchfab — ZeroStateReflex · 2026-08-27
- 生产环境如何检测技术成功但内容失败的 LLM 输出 — Choice-Attorney8884 · 2026-08-27
- FrontierAgent 开源:支持科研金融任务的本地 Agent 框架 — SimonShaoleiDu · 2026-08-27
- SiteSpeakAI 推出 Google Chat 集成,知识库问答进群聊 — hermanschutte · 2026-08-27
- Apodex 发布 Qwen3.5-MoE 驱动的多模态 Agent 模型 — apodex · 2026-08-27