AMD Strix Halo 上构建 llama.cpp Laguna,ROCm 仍卡在 flash-attn

dbinnunE3 · reddit · 2026-07-22

这是一篇非常具体的 本地大模型部署/编译实战记录:作者在一台 AMD Strix Halo 机器上,用 Fedora toolbox + ROCm/HIP 去构建 poolsideai/llama.cpp 的 laguna 分支,并做基准测试。

关键过程

实测结果

卡住的地方

整体上,这是一篇对 AMD 本地推理栈很有参考价值的工程踩坑帖。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →