每日自动选任务跑 23 天:41 次运行 19 次上线,失败 54% 反而是特性

PretendLime6041 · reddit · 2026-09-03

作者分享了一个跑了 23 天的自主 agent 循环:每天早上 6 点 GitHub Actions 触发,agent 读取搜索数据、用量数据和历次尝试日志(含失败原因与成本),生成候选任务、排序后只承诺执行一个,再走计划-实现-测试全流程。

关键机制:任何改动必须通过 81 项自动化检查才能上线,不过关就安静死掉并写入日志,成为次日决策的输入——作者认为这是系统里唯一的「学习」发生处。

8 月 11 日至 9 月 2 日的账目:41 次运行,19 次上线,22 次失败(54% 失败率)。作者主张这个失败率正是特性:如果追求高成功率就得放松检查,回到人工审 diff 的老路。上线的 19 个里 7 个是循环自身机制的改动,12 个是内容页,全部文案由 agent 写就,作者零编辑。

两个观点:

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →