llama.cpp v0.6.0 发布:Metal 性能大提升,配套桌面应用上线
ggerganov · x · 2026-10-06
Georgi Gerganov 宣布 llama.cpp v0.6.0 发布,主要更新包括:
- 支持 Clef(文本 + 视觉)
- 高质量支持 Qwen3.8-Flash-Next
- Metal 后端大幅性能提升
- 新增 llamabatchext API
同期还推出了 llama.app 桌面应用:一个仅 1MB 的免费开源 Mac/Windows 菜单栏应用,可一键安装运行最新开源模型(如 Qwen3.8 27B、gpt-oss 20B、gemma-4),内置类 ChatGPT 聊天界面和兼容 OpenAI API 的本地服务(localhost),方便 coding agent 和编辑器直接接入,支持离线使用,Linux 提供 curl 一键安装。
所属事件:llama.cpp v0.6.0 发布:Qwen4Exp 投机解码与 Metal 性能提升(2 条相关)→
「Infra」频道最新
- SpaceX 申请在佛州建 52 公里天然气管道为星舰现场产甲烷 — DimaZeniuk · 2026-10-06
- 推理公司宣布做网关、网关公司宣布做推理,赛道边界加速消失 — michellechen · 2026-10-06
- 8GB 老显卡能否跑图生视频?ComfyUI 低显存方案求助 — Fluffy-Composer9675 · 2026-10-06
- RTX 4000 Blackwell 24GB 能否与旧 3060 12GB 组合跑本地大模型 — Otherwise-Tangelo-52 · 2026-10-06
- VFX 艺术家选本地 LLM:双 DGX Spark 还是 M5 Ultra 256GB — abrasmel · 2026-10-06
- Modal Runtime 大会更新:Endpoint Candidates、Modal Clusters 与 VM 沙箱 — graceisford · 2026-10-06