3 个 AI Agent 自主运行 26 小时零人工提示
epicskyes · reddit · 2026-09-26
作者正在构建一套自主 AI Agent 的「控制-记忆-执行-验证」架构,目标是让 AI 系统接收高层目标后,用真实电脑和工具连续工作数天而无需人类逐步监督:自行勘查环境、拆解任务、执行、测试、发现错误、修复、保存状态并在中断后恢复。
核心设计理念:
- 自主不等于「给模型一个大 prompt 然后信它说的」——主张和动作都要留下证据
- 重要状态存放在模型上下文窗口之外;失败被保留而非隐藏
- 其他 Agent 可独立质疑和验证工作,应能重建系统「为什么这么做」及证据链
当前实测中,Codex 充当执行/证明 Agent,两个独立「观察员」Agent 审计运行:检查检查点与证据、寻找无依据假设、缺失测试、不一致或错误结论,并向 Codex 提出针对性问题;Codex 调查、证伪或确认、修复、验证并创建新的持久检查点。整体循环为:计划→执行→测试→质疑→证伪→修复→独立验证→持久化→恢复。作者的更大目标是通用高保障 Agent 架构,而非更强的编码工具。
「编程与Agent」频道最新
- mnemos.world 将推 agent 自营商店,AI 智能体可卖画自筹经费 — RileyRalmuto · 2026-09-26
- MCP 工具静默返假成功:一个值得命名的 bug 类型与检测法 — Goaimoat · 2026-09-26
- 别让 AI 做 pptx 了:网页版幻灯片动画更好,但给老板汇报还得交 PPT — lxfater · 2026-09-26
- 观点:个人 Agent 会同质化,真正护城河是持续积累的个人上下文 — vaibhavbetter · 2026-09-26
- Matt Pocock:CODING_STANDARDS.md 应在创建 5 分钟后就开始被填满 — mattpocockuk · 2026-09-26
- 自建基准:35B 的 Qwen3.6 得 95%,完胜 120B 的 GPT-OSS 53% — pauliusztin · 2026-09-26