32GB 显存跑 Qwen3.8-27B 写代码,社区征集本地模型选型经验
theexile1337 · reddit · 2026-09-08
Reddit 用户分享自己的本地 LLM 配置:32GB 显存下用 Qwen3.8-27B(Q4/Q6 量化,视上下文需求切换)写代码,偶尔用 Gemma4 31B 做研究与一般问答,以避免把隐私内容发给云端模型。
他询问是否有网站可以按用途对比本地模型,并征集其他人的本地模型、量化方案与显存搭配经验,评论区是本地部署选型的一手数据集散地。
「编程与Agent」频道最新
- Spotify 用 350 行拦截规则让 Claude Code 省 90% token — krishnan · 2026-09-08
- 开发者想为 AI agent 建非正式数学库,征名 mathgraph — Sauers_ · 2026-09-08
- Ix 用 tree-sitter 建代码库符号图谱,26 种语言即查即用 — tom_doerr · 2026-09-08
- 开发者自建 FreeBuff MCP,让 GPT 免费调用 DeepSeek 等 execution agent — Swimming_Ask3859 · 2026-09-08
- GitHub 把 agent 策略拦截归为 skipped 而非失败,监控语义更精细 — Crescitaly · 2026-09-08
- iMessage 版 AI 助手 Companion 发布:复用 ChatGPT 账号、支持 MCP — Scobleizer · 2026-09-08