Zvi 谈水印与约束:非主要降低 x-risk,需测试

TheZvi · x · 2026-08-19

Zvi 对 AI 安全问题发表看法,认为虽然水印技术使输出可识别,有助于遏制部分边际威胁模型,但他不认为这主要在于降低 x-risk。

他回应关于增加系统约束是否有助于防止灾难的质疑时表示,他并非通过第一性原理推理,而是期望在类似领域通过对抗性测试获得信心,因为副作用可能难以预测。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →