Google 说,Agent 行为来自 prompt、评测与反馈闭环
AI Engineer · youtube · 2026-07-25
Google 团队在这场分享里强调:让 AI agent 按你想要的方式工作,靠的不是更会写 prompt,而是 prompt、eval、迭代和反馈组成的闭环。
他们以一个 seed-asset agent 为例,说明这个系统如何把凌乱的广告创意素材——低质量图片、杂乱版面、重文字覆盖——处理成可供后续生成式 AI 工具复用的干净资产。分享中的几个关键点是:
- 只靠 prompt,行为并不稳定;
- eval 更适合作为反馈信号,而不只是打分表;
- agent 的 trace log 能帮助定位失败原因;
- 迭代时必须避免把已经修好的问题重新引入。
演讲者包括 Google 的 Chris Souza、Preetika Bhateja 和 Daniel Bump。
「编程与Agent」频道最新
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11