stuntd 0.1.2:本地小头替模型做决策,最弱字段决定省多少调用

Inevitable-Log5414 · reddit · 2026-10-01

作者发布开源代理工具 stuntd 0.1.2:学习你 LLM 应答中的类型化决策(如工单分类),置信度高的问题由 20ms GPU / 60ms CPU 的本地小头直接回答,其余才调用大模型。

代码在 GitHub(bladedevoff/stuntd),Hugging Face Space 可直接试用。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →