llama.cpp 合并 PR:支持在 CUDA 上运行三进制 8B 模型

413205 · reddit · 2026-07-30

llama.cpp 已合并一项新的 PR,正式支持在 CUDA 环境下运行 Ternary-Bonsai-8B-Q20.gguf 模型。这意味着开发者可以在 GPU 加速下测试该三进制大模型的实际性能表现。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →