llama.cpp 合并 DFlash2 支持:本地卷积加候选选择器

DjCanalex · reddit · 2026-08-28

llama.cpp 的 PR #27342 已合并,为推理框架加入 DFlash2 支持,实现方式是「本地卷积(local convolution)+ 候选选择器(candidate selector)」。这意味着使用 llama.cpp 做本地/端侧部署的用户可以直接跑 DFlash2,属于本地推理栈的一次实用性扩展。

所属事件:llama.cpp 合入 DFlash2 支持,引入局部卷积与候选选择器(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →