HF 研究员:「做比评难」,agent 工作流应更多让模型兼任生成与评判
antoine_chaffin · x · 2026-09-21
Hugging Face 研究员 antoinechaffin 提出一个简洁观点:「做比批评更难」,这正是 GAN 和强化学习有效的原因。他认为好在我们现在可以同时用模型来「做」和「评」,并且应该在 agentic 工作流中更多利用这一点——即让模型既当生成者又当批评者,以提升智能体系统的表现。
「编程与Agent」频道最新
- GPT-6 Astra 做 15 秒广告:逐帧拆解后重做,18 分钟出 5 版 — PrajwalTomar_ · 2026-09-21
- Sentry CEO 力挺 headless:每天让 agent 读监控告警,标出 P0/P1 — zeeg · 2026-09-21
- Clairvoyance 发布:给 AI 模型接上你的数据并生成元数据索引 — draginol · 2026-09-21
- 用 MCP 让 Astra 与 Fable 联机玩过山车大亨,实测 computer use 能力 — scaling01 · 2026-09-21
- MiniMax H3 成功跑在 4060 Ti 16GB 上,作者分享完整工作流设置 — GranDaddyP · 2026-09-21
- 研究者提出新思路:让模型内化功能,替代越造越复杂的 harness — multiply_matrix · 2026-09-21