安全学者质疑安全案例实践:对齐评估难以量化绝对风险

dhadfieldmenell · x · 2026-09-18

安全研究者 w01fe 转评多条头部 AI 实验室承诺开发 safety cases 并加强与外部评估机构合作的声明,认为这是其长期呼吁的方向,但对实际落地仍有担忧:

这可能导致外部评估者只能给出「我们无法令人信服地……」式的模糊结论。作者强调这是针对整个领域的方法论局限,而非针对 OpenAI 一家。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →