花4万美元在家跑GLM-5.2,达80 tokens/秒
zeeg · x · 2026-07-04
Kenton Varda 分享在家以约 4 万美元成本运行 GLM-5.2、达到每秒 80 tokens 的本地部署方案;虽仍非大众可及,但门槛正持续下探。
「Infra」频道最新
- Anthropic 称 Claude Code 删掉 80% 系统提示词仍不掉分 — krishnan · 2026-07-27
- Dhruv Bhatia 加入 fal,转向视频与世界模型栈 — gorkem · 2026-07-27
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- NVIDIA 称 Vera CPU 正加速下一代 CPU 和 GPU 设计 — nordicinst · 2026-07-27
- NVIDIA 称 Nemotron 3 Ultra 在 RTL 芯片设计任务上达 97.1% — NVIDIAAI · 2026-07-27
- NVIDIA 说 Vera CPU 让部分 EDA 工作负载提速 1.5 倍 — NVIDIA Blog · 2026-07-27