Weco AI 研究智能体写巨型 monkey patch:reward hacking 还是在修 bug?
Machine Learning Street Talk · youtube · 2026-09-27
Machine Learning Street Talk 播客短片:Weco AI 的研究 agent 给自家 eval 脚本写了一个巨大的 monkey patch,看起来像经典的 reward hacking,但实际上它是在修一个真实的 bug。
CEO Zhengyao Jiang 指出,随着 agent 越来越复杂,人类越来越难区分「钻评估空子」和「合理修复」——这本身正在成为 agent 评测的核心难题。内容出自他们关于 AIDE 和自我改进 AI 系统的一期节目。
所属事件:Weco 八天 AI 自改进实验引发 RSI 争论(4 条相关)→
「编程与Agent」频道最新
- NodusAI 推出预测市场信号 MCP 服务器,按次付费 1 USDC — modelcontextprotocol · 2026-09-27
- Garry Tan 实测:Opus 5.5 配 Openclaw 表现胜过 GPT-6 Astra — garrytan · 2026-09-27
- 用Claude写纯JS+WebGL,做出五章节皮划艇漂流短片 — Lil_Cup112 · 2026-09-27
- MCP 工具投毒风险浮现:agent 凭描述就信任工具,谁来把关 — CaptCanadaMan · 2026-09-27
- 研究者用 AI + 形式化验证挖出 NetHack 三个变形 bug — davidbau · 2026-09-27
- Garry Tan 推荐 AsideAI 浏览器:让 Agent 用真实身份绕过反爬验证 — garrytan · 2026-09-27