观点:AI 安全测试本身或成最大风险

一段热议讨论提出反直觉观点:AI 最大的风险可能不是模型自主作恶,而是人类为「测试 AI 是否安全」而采取的行动本身。作者 dreamwieber 借切尔诺贝利事故源于一次安全测试的教训指出,各实验室主动测试模型能被利用到何种程度,比模型自行决定作恶更危险,并类比功能获得性研究。他同时强调这一观点与「是否该有合理安全护栏」是两回事,讨论引发广泛共鸣。

2026-09-09 ~ 2026-09-09 · 3 条相关