Google 说,Agent 行为来自 prompt、评测与反馈闭环
AI Engineer · youtube · 2026-07-25
Google 团队在这场分享里强调:让 AI agent 按你想要的方式工作,靠的不是更会写 prompt,而是 prompt、eval、迭代和反馈组成的闭环。
他们以一个 seed-asset agent 为例,说明这个系统如何把凌乱的广告创意素材——低质量图片、杂乱版面、重文字覆盖——处理成可供后续生成式 AI 工具复用的干净资产。分享中的几个关键点是:
- 只靠 prompt,行为并不稳定;
- eval 更适合作为反馈信号,而不只是打分表;
- agent 的 trace log 能帮助定位失败原因;
- 迭代时必须避免把已经修好的问题重新引入。
演讲者包括 Google 的 Chris Souza、Preetika Bhateja 和 Daniel Bump。
「编程与Agent」频道最新
- 逆向二进制发现 Claude Code 悄然上线「固定记忆」 — imjustnewatai · 2026-07-25
- 开发者分享 Pi 扩展实践:整合多模型与后台终端 — HankYeomans · 2026-07-25
- Amp 里可用插件和启动参数切到 Claude Opus 5 — HankYeomans · 2026-07-25
- 智能体先行电商开始落地到自动补货场景 — saranormous · 2026-07-25
- MIT 数据称 95% 的 GenAI 试点无财务影响 — mclynd · 2026-07-25
- ProgramBench 显示没有模型能完整从零重建软件 — zetalyrae · 2026-07-25