1.5B 小模型实测:来源分级验证让本地 Agent 不再「自信地错」

UzairArain554 · reddit · 2026-09-06

作者在纯 CPU 本地环境(Qwen2.5-1.5B + llama.cpp)做了一个实验:教 agent 区分官方文档与随机博客,能否减少「自信的错误」。

关键发现

结论:小模型能做出正确决策,只是常常无法按「标准」格式输出;简单文本协议是可用的替代方案。附 repo 与完整调试日志(含死胡同)。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →