llama.cpp 集成 Moonshot Kimi-K3 文本模型
pmttyji · reddit · 2026-08-15
一个Pull Request提议将Kimi-K3文本模型添加到ggml-org/llama.cpp项目中。这允许开发者在本地设备上运行Moonshot发布的Kimi-K3模型,进一步增强了llama.cpp对国产大模型的支持。
「Infra」频道最新
- Qwen3.8 27b 在 M5 Max 128GB 上跑分实测 — julianharris · 2026-08-16
- 模型推理的证明缺失:谁能证明跑的是哪个权重? — Some_parts_Bi · 2026-08-16
- WeeLLM:4GB 显存无损运行 FLUX.1 等大模型 — AlarmingPhrase8174 · 2026-08-16
- 企业 AI 采购推动联想利润率创纪录,服务利润率达 PC 三倍 — shashib · 2026-08-16
- 分析师称谷歌 TPU 逐代直采更多台积电晶圆,IP 伙伴利润承压 — BenBajarin · 2026-08-16
- Baseten 首日支持 Qwen3.8-27B 微调 — baseten · 2026-08-16