新工具 runapex 让小模型实时自检,写代码时自动回滚幻觉

lovettsendit · reddit · 2026-08-31

作者发布了检测 AI 代码幻觉的工具 Hedgemony,并演示了正在开发的新工具 Runapex。Runapex 能在生成过程中实时监测模型内部状态,一旦发现模型开始“撒谎”即中断并回滚,强制重试。实测显示其能将谎言率从 80% 降至 20% 以下。系统支持向小模型前置注入参考资料,并确保验证过程不受注入影响。当小模型无法完成时,会自动升级给更强的 Agent 处理,且全程不信任任何环节。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →