本地 Qwen 复刻 Jev 决策:精度持平 96.53%,延迟还更快

Ok-Development6070 · reddit · 2026-09-19

开发者不想把数据发给第三方服务器,于是做了 TypeScript 小包 choosekit,用 llama.cpp 本地跑 Qwen3.8 27B (Q4) 实现 Jev 式的选项+概率决策。

在 SemIf 的 144 任务基准上与 Jev 托管 API 对比:两者精度完全相同(96.53%),但本地 Qwen 中位响应 239 ms,反而快于托管 API 的 368 ms。完整设置和结果已开源在 GitHub。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →