Kimi K3 量化 Q1 一发写出可用代码,GLM5.3 API 跑7小时完工
segmond · reddit · 2026-08-19
帖子征集各新模型实际表现,并分享自测:Kimi K3 本地 Q1M 量化版「一发写出大量可用代码」令人惊艳,正努力凑算力跑 Q2/Q4;GLM5.3 通过 API 实测,给它一个服务器完全访问权限,跑了约 7 小时完成搭建 vLLM 并打自定义补丁的认真活,印象深刻。目前正在下载 DeepSeek-V4-Pro-0813-Q2,想看 Q2 下能否保持连贯并超过 Flash Q8;Qwen3.8-2.4T 讨论度低、声量下滑,想知道它能否跟上 K3。
「Infra」频道最新
- 链上 AI 网关激增,Stripe 或将整合廉价推理服务 — 0xJeff · 2026-08-19
- Meta 用 CXL 复用 DDR4 内存,降服务器成本 25% — BenBajarin · 2026-08-19
- llama.cpp 修复GPU全卸载下CPU单核100%占用Bug — MelodicRecognition7 · 2026-08-19
- NVIDIA 发布 PyG 26.07,集成 GNN+LLM 图 RAG 框架 TrueQuery — AllThingsApx · 2026-08-19
- 高通 CEO 谈 Modular 收购与 AI 推理生态愿景 — samcharrington · 2026-08-19
- Transformer 推理算力冗余巨大?计算智能的物理下限尚不可知 — prateekj · 2026-08-19