临床试验早是人形反 reward hacking 机制,陶哲轩担忧被指打错靶

tallinzen · x · 2026-10-12

围绕陶哲轩对 AI 在药物研发中 reward hacking 的担忧,Michael Eisen 回应称这并非新问题:药物本是大生意,临床试验流程在结构上就是对人类/公司 reward hacking 的对冲,而且实践中常被「黑」——但方式是腐蚀流程本身,而非陶设想的「AI 设计出看起来有效的东西」。他认为陶的担忧方向不假,只是例子举错了。tallinzen 补充:即便只看那页幻灯片,讨论焦点显然是对齐与 reward hacking,而非「在机理未明时使用药物」。

所属事件:AI 奖励黑客引发热议:药物试验漏洞或被模型利用(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →