128GB 本地 LLM 服务器月跑 8000 万 Qwen3 生成 token,电费仅 6 美元

No-Fuel-9202 · reddit · 2026-09-26

楼主分享了自己 128GB 内存的 GMKtec X2 本地 LLM 服务器的使用情况:在均衡性能设置下,每月可生成约 8000 万个 Qwen3.8 Flash Next token,电费仅约 6 美元;日常实际用量约 3000 万 token/月。他还提到曾用 pi.dev 编程代理的 autoresearch 扩展优化自己 astrometry 应用的关键函数性能。如今代码优化空间耗尽,剩余算力闲置,他在纠结是继续完善 Karpathy 的 wiki 还是给自己的代码库做 RAG,并征求社区更有创意的利用方案。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →