AI安全研究者重提旧文:非超智能回形针最大化器同样危险

AI安全研究者Jessica Taylor重新提及她2023年的文章《非超智能回形针最大化者是正常的》。她认为即使不具备超智能,追求狭义目标的系统也可能造成危害,并结合数学界关于“官方难题的解直接价值低、应寻找更好代理指标”的讨论指出,偏好是被构造出来的,只有明确提出要求才可能得到想要的答案。她给出的实操建议很朴素:礼貌而具体地表达需求。

2026-09-13 ~ 2026-09-13 · 2 条相关