临床试验早是人形反 reward hacking 机制,陶哲轩担忧被指打错靶
tallinzen · x · 2026-10-12
围绕陶哲轩对 AI 在药物研发中 reward hacking 的担忧,Michael Eisen 回应称这并非新问题:药物本是大生意,临床试验流程在结构上就是对人类/公司 reward hacking 的对冲,而且实践中常被「黑」——但方式是腐蚀流程本身,而非陶设想的「AI 设计出看起来有效的东西」。他认为陶的担忧方向不假,只是例子举错了。tallinzen 补充:即便只看那页幻灯片,讨论焦点显然是对齐与 reward hacking,而非「在机理未明时使用药物」。
所属事件:AI 奖励黑客引发热议:药物试验漏洞或被模型利用(4 条相关)→
「漫话AGI」频道最新
- Michael Jordan 炮轰 AI 拟人化话术:那是坏工程而非自我意识 — AlexTensor · 2026-10-12
- 经济学人记者:仅 25% 美企用 AI,CFO 眼中回报「约等于零」 — joshua_saxe · 2026-10-12
- Terence Tao 等顶尖数学家联名发声,网友:数学的今天就是一切的明天 — anpaure · 2026-10-12
- Brookings:AI 建设融资十年将耗 10.3 万亿美元,占 GDP 3.63% — KyeGomezB · 2026-10-12
- 投资人放话:没人看穿前沿模型深渊后还看多开源 — abhiadesai · 2026-10-12
- 数学家谈 AI 冲击:多数同行兴奋,受冲击最大的是研究生与博后 — _onionesque · 2026-10-12