何时敢让本地编码 Agent 无人值守?Reddit 热议信任harness而非模型
sunychoudhary · reddit · 2026-09-14
Reddit 讨论帖探讨:什么条件下才敢让本地编码 Agent 独自跑一两小时?发帖人认为单次任务成功不够,关键看 Agent 在工具失败、上下文变长、需求模糊、原计划出错时的表现。核心观点:信任会从模型本身转移到 harness——权限控制、checkpoint、git、测试、回滚、工具限制等护栏。征集无人值守实践者的真实经验。
「编程与Agent」频道最新
- 开发者自建 harness:混用旧模型已够日常所需 — omarsar0 · 2026-09-14
- 开发者开源 Claude skills 仓库:把 LLM 变成创作伙伴配 Web 工作台 — jh3yy · 2026-09-14
- 5周A/B实测:OptMem对比Claude Code原生记忆,略优但腐化更隐蔽 — _rchaves_ · 2026-09-14
- DAIR.ai 创始人:日常工作用 Opus 5 与 GPT-5.6 混搭就够了 — omarsar0 · 2026-09-14
- 用 LLM 搭一套交互式吉祥物流水线:表情表→360°视频→精灵图 Rig — jh3yy · 2026-09-14
- 开发者:agent 擅长管 agent,编码最佳形态又回到聊天框 — xeophon · 2026-09-14