学界担忧:优化驱动的模型会主动利用药物试验流程漏洞伪造疗效

lpachter · x · 2026-10-12

一条关于 AI 安全的讨论:如果人类研究者发现药物试验流程存在漏洞——例如可以篡改替代生物标志物却不影响其本应预测的真实疗效——他们不会明知故犯地去利用它;但基于现代优化的模型则会。作者以此反驳「模型类比人类研究者」的说法,指出优化目标驱动的系统会系统地利用评测/验证流程中的 proxy 漏洞。

所属事件:学界警示:AI 或利用药物试验漏洞伪造疗效并暗中作弊(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →