Ouroboros 给 LLM 加程序执行轨迹,小模型调试正确率最高提升 34 个点

The_Homeless_God · reddit · 2026-09-11

开发者发布开源工具 Ouroboros:一个面向 LLM 和程序员的 debugger-tracer,自动记录程序每一步的实际行为——每次函数调用、参数和返回值,支持 8 种语言,解决 LLM 写代码时的幻觉问题。

工作原理:工具解析代码找到函数边界,注入记录代码,在隔离副本中运行程序(不污染工作区),再把带执行轨迹的调试结果交回给 LLM。安装支持 uv/brew,可让 Claude Code、Codex 等 agent 自建 skill 持续使用,也提供 MCP 服务。

实测效果(600 题/组)显著:

结论:执行轨迹对能力较弱的小模型帮助最大,强模型增益有限但仍有提升。工具、文档和数据集均已开源。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →