128GB 本地 LLM 服务器月跑 8000 万 Qwen3 生成 token,电费仅 6 美元
No-Fuel-9202 · reddit · 2026-09-26
楼主分享了自己 128GB 内存的 GMKtec X2 本地 LLM 服务器的使用情况:在均衡性能设置下,每月可生成约 8000 万个 Qwen3.8 Flash Next token,电费仅约 6 美元;日常实际用量约 3000 万 token/月。他还提到曾用 pi.dev 编程代理的 autoresearch 扩展优化自己 astrometry 应用的关键函数性能。如今代码优化空间耗尽,剩余算力闲置,他在纠结是继续完善 Karpathy 的 wiki 还是给自己的代码库做 RAG,并征求社区更有创意的利用方案。
「编程与Agent」频道最新
- Anthropic 两周提速 3 倍方法复盘,作者照做整理成「闪电.skill」 — AlchainHust · 2026-09-26
- 4D 文档 MCP 服务器上线:带缓存的 VS Code 扩展助力 AI 编码 — modelcontextprotocol · 2026-09-26
- 按构建难度排序:计算机操作 agent 最难,邮件 agent 最简单 — sahilypatel · 2026-09-26
- BrainAPI 开源:知识图谱驱动的 AI Agent 记忆层,482 星 — adnan_hashmi · 2026-09-26
- Agent 委派权限难题:子 Agent 是否继承父 Agent 权限? — Fantastic-Sleep-3352 · 2026-09-26
- Reddit 封杀未登录访问,开发者推出借 Chrome 登录态读取的免费 MCP — investigatormaker · 2026-09-26