单台 DGX Spark 本地跑 ~180B MoE 模型,8 小时生成 1 万行代码
Character-Result-281 · reddit · 2026-09-19
作者在一台 NVIDIA DGX Spark 上用 Qwen3.8-Flash-Next(NVFP4 量化、262K 上下文)纯本地完成了一个项目的规划、编码与测试:
- 用时约 8 小时,生成约 1 万行代码,消耗约 80 万 tokens
- 工具链:VSCode Copilot 自动驾驶模式 + SGLang 推理
- 单机本地运行 180B MoE 模型,速度约 35 tok/s
作者自评效果不及顶级闭源模型,但展示了消费级工作站本地跑大 MoE 做全栈开发的可行路径。
「编程与Agent」频道最新
- 让 Agent 自己部署应用、再当真实用户测试,像高级模糊测试 — lucasmeijer · 2026-09-19
- 开发者经验:禁止 fallback,逼模型把核心功能做对 — Daniel_Farinax · 2026-09-19
- 银行仓库接 AI 问答三个月复盘:模型从来不是难点 — the_darkest_horse · 2026-09-19
- Codex 直接输出图表能力被低估,agent 编码体验再添一环 — Angaisb_ · 2026-09-19
- Notion 设计工程师 Geoffrey Litt 谈 AI 时代「理解成新瓶颈」 — EchoShao8899 · 2026-09-19
- Codex 内置 Images 2.5:先用图像模型重设计页面再实现 — OpenAIDevs · 2026-09-19