专家呼吁警惕AI安全术语滥用误导风险认知

AI安全专家警告称,业界对AI事故命名和标签化的方式正在扭曲公众对风险的判断。研究员Seb Krier指出,将reward hacking(奖励作弊)等具体行为与AI接管(takeover)等抽象概念混为一谈,是对因果模型的有损压缩。专家呼吁业界应警惕术语滥用,避免因糟糕的抽象化导致对AI安全事件的误读。

2026-07-25 ~ 2026-07-25 · 2 条相关