llama.cpp 合并 DFlash2 支持:本地卷积加候选选择器
DjCanalex · reddit · 2026-08-28
llama.cpp 的 PR #27342 已合并,为推理框架加入 DFlash2 支持,实现方式是「本地卷积(local convolution)+ 候选选择器(candidate selector)」。这意味着使用 llama.cpp 做本地/端侧部署的用户可以直接跑 DFlash2,属于本地推理栈的一次实用性扩展。
所属事件:llama.cpp 合入 DFlash2 支持,引入局部卷积与候选选择器(2 条相关)→
「Infra」频道最新
- MiniMax-H3 跑 8×H200:无损加速 1.95 倍,最高 6.24 倍 — ying11231 · 2026-08-28
- Architect Labs 称 AI 两周设计出芯片 Redwood,能效比号称超 NVIDIA — mark_k · 2026-08-28
- GMI Router 推出 KV 缓存感知模型路由 — anthara_ai · 2026-08-28
- 暂停并恢复云 GPU:不丢失 ComfyUI 环境的省钱技巧 — deployonaquanode · 2026-08-28
- 手把手:用 Terraform 与 GitHub Actions 将 Agent 部署至 AWS ECS — kmeanskaran · 2026-08-28
- AMD ROCm 10.0.0 发布:扩展支持矩阵并简化安装流程 — AnushElangovan · 2026-08-28