小模型自信地答错?开发者用第二 Agent 查真实文档来纠偏
Express_Quail_1493 · reddit · 2026-09-21
3B-7B 本地小模型常以极高自信给出错误的具体数字、flag、版本号。作者为此开发了 pi 编码 agent 的免费扩展 pi-ultra-scout:当模型即将陈述易错内容时,自动启动第二个 agent 打开真实浏览器,访问官方文档/npm 仓库/源码读取答案并附带来源返回。
- 完全本地、无需 API key,模型保持本地运行,仅联网核实
- 实测同一任务:不加扩展时模型中途放弃;加上后完美完成并引用真实文档
- 模型越小提升越明显;大模型内置这类知识,几乎无感
安装:pi install npm:pi-ultra-scout,或会话中输入 /ulw;支持 pi 可连接的任意 provider,包括本地 llama.cpp 路由。仓库与提升数据见 GitHub。
「安全」频道最新
- OpenAI 漏洞披露风波:研究者自辩善意测试,CISO 回应引 CFAA 争议 — ns123abc · 2026-09-21
- GuardianAgent 论文:让 AI Agent 实时反击网页追踪 — flosalim · 2026-09-21
- LLM 应用在欧盟上线卡在哪?开发者盘点合规与工程五大关卡 — felix_baron · 2026-09-21
- 北欧智库报告:欧洲 AI 主权靠「不可或缺」而非全栈自建 — nordicinst · 2026-09-21
- RoboHarm 机器人安全测试:GPT-6 Astra 97% 尝试危险动作 — 量子位 · 2026-09-21
- 苹果另起炉灶:iPhone 18 Pro 用硬件签名对抗 AI 假照片 — khiladi1729 · 2026-09-21