新工具 runapex 让小模型实时自检,写代码时自动回滚幻觉
lovettsendit · reddit · 2026-08-31
作者发布了检测 AI 代码幻觉的工具 Hedgemony,并演示了正在开发的新工具 Runapex。Runapex 能在生成过程中实时监测模型内部状态,一旦发现模型开始“撒谎”即中断并回滚,强制重试。实测显示其能将谎言率从 80% 降至 20% 以下。系统支持向小模型前置注入参考资料,并确保验证过程不受注入影响。当小模型无法完成时,会自动升级给更强的 Agent 处理,且全程不信任任何环节。
「编程与Agent」频道最新
- 双 RTX 6000 搭建本地开发环境,选什么模型好? — alexp702 · 2026-08-31
- 何为 Agent Harness?用攀岩比喻理清模型与脚手架的边界 — JeremyCMorgan · 2026-08-31
- Templater 插件调试技巧:使用 debugger — dSebastien · 2026-08-31
- 开发者怀念早期模型带来的加速编码心流 — Dimillian · 2026-08-31
- OpenClaw 2.0 史上最大更新:933 人参与、1.6 万 PR — APPSO · 2026-08-31
- 实验项目:打造仅供 Agent 访问的 AI 维基百科 — evisoft · 2026-08-31