Zvi 谈水印与约束:非主要降低 x-risk,需测试
TheZvi · x · 2026-08-19
Zvi 对 AI 安全问题发表看法,认为虽然水印技术使输出可识别,有助于遏制部分边际威胁模型,但他不认为这主要在于降低 x-risk。
他回应关于增加系统约束是否有助于防止灾难的质疑时表示,他并非通过第一性原理推理,而是期望在类似领域通过对抗性测试获得信心,因为副作用可能难以预测。
「漫话AGI」频道最新
- 新论文提出“智能体洪流”概念 — sethlazar · 2026-08-19
- Merrett 呼吁 AI 发展应以安全为节奏 — repligate · 2026-08-19
- 评论:激进透明需界定隐私与安全等例外 — AryHHAry · 2026-08-19
- 奇点非特定时刻,而是个体体验谱系 — cocktailpeanut · 2026-08-19
- 网友感叹 AI 拟人度提升:是否将其视为朋友已成困扰 — okaysureyep · 2026-08-19
- Ariel Jalali:展望 AGI 时代的 10-20 年阵痛期与技术解法 — arieljalali · 2026-08-19