AI 验证领域已成熟到必须先回答「验证的是什么」
ohlennart · x · 2026-10-09
研究者 ohlennart 提出对 AI verification 领域的观察:这个领域已足够成熟,谈论它时必须先回答「验证什么?」
他认为核心挑战正在于此:你通常能验证的是一个狭窄的技术性声明,但如何把它与真正重要的东西(模型实际行为、安全性承诺)连接起来,才是关键难题。这是对可验证性主张泛化鸿沟的点题式批评。
「安全」频道最新
- Anthropic 新规禁止虐待 Claude,被批「人造拟人化卖恐惧」 — gerardsans · 2026-10-09
- OpenAI 一周内解雇三名安全员工,理由是访问高管邮件 — Miles_Brundage · 2026-10-09
- OpenAI 安全研究员自曝被保安护送离职,起因是与 METR 沟通 — tomekkorbak · 2026-10-09
- Anthropic 更新使用政策:明确禁止滥用 Claude 与干预选举 — TechCrunch AI · 2026-10-09
- 博主吐槽 Claude 护栏:女性身体再非色情场景也要遮蔽 — flowersslop · 2026-10-09
- 美国私人AI投资是中国的23倍,模型领先却只剩2.7% — heyshrutimishra · 2026-10-09