开发者实测:同一个 agent 既写代码又自验,坑在哪
T_hompson · reddit · 2026-09-29
一位做交易机器人和数据监控工具的开发者分享:用 AI 协作开发时,模型反复宣称「一切正常」,但后续任务中早期实现的问题(分页不完整、API 数据缺失、漏记录)才暴露。他质疑用同一上下文既做实现又做验证是否有问题,并询问分离角色的多 agent 流水线(Developer → Reviewer → Test)是否真正可靠,担心多个 agent 只是「自信地互相认同错误」。帖子本身是开放讨论,评论区有相关实践经验可供参考。
「编程与Agent」频道最新
- 开源 VeriChron AI:用双时态数据重建任意时点的企业合规状态 — LoksaiPalyam · 2026-09-29
- 让 AI 写架构决策记录:Staff 工程师的选择题 prompt 模板 — JafarNajafov · 2026-09-29
- 「像福尔摩斯一样调试」prompt:先列 5 个根因再动手修 — JafarNajafov · 2026-09-29
- 别把 Claude 当 Stack Overflow 用:11 个可直接复制的编码 prompt — JafarNajafov · 2026-09-29
- 视频转写纠错思路:抽音抽帧+ASR+前沿模型结合画面修正 — capetorch · 2026-09-29
- bdsqlsz 近期用 vibe coding 训练 DLSS5 权重,为自研 3D 游戏做准备 — bdsqlsz · 2026-09-29