为什么你的本地 LLM 感觉比实际更笨
johnnyApplePRNG · reddit · 2026-08-23
一篇 Level1Techs 论坛文章,讨论本地部署的 LLM 用起来感觉比模型实际能力更差的原因,涉及部署与推理配置等工程因素。
「Infra」频道最新
- 实验计划:Mac 本地跑 Qwen 模型对抗云端安全扫描 — natesiggard · 2026-08-23
- 双 R9700 运行 vLLM:多实例导致吞吐减半 — Certain_Series6810 · 2026-08-23
- 12GB 显存最佳模型推荐:除了 GLM 4.7 Flash 还有什么? — OrangeThink5911 · 2026-08-23
- 预测市场:AI 泡沫今年破裂概率仅 12% — Polymarket · 2026-08-23
- 传英伟达对部分大客户提价 AI 服务器 15%+ — Polymarket · 2026-08-23
- 同一模型普通聊天 27t/s,挂上 Agent 框架只剩 15t/s — WizardlyBump17 · 2026-08-23