本地跑 Qwen3.8-27B:10GB 显存、170ms 延迟、多模态决策

kyr0x0 · reddit · 2026-09-23

作者发布 Bonsai-Llama-Jev,一个基于 Qwen3.8-27B Q264 与 llama.cpp 的本地「类型化决策」推理系统,保留 OpenAI API 兼容。

关键数据

技术要点

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →