Anthropic 研究员:失控风险是未解科学问题,审计不能吹成安全保证
ajeya_cotra · x · 2026-09-27
Anthropic 研究员 Ajeya Cotra 提出,"防止失控"仍是一个开放的科学问题,而科学要求公开分享和辩论证据;公司与第三方评估者必须发布更具体的风险证据,否则无法就安全标准达成共识。
Nat Purser 回应称,把独立审计包装成"安全保证"并不准确——失控评估尤其还是不成熟的科学领域。他定位:独立监督是更广泛治理框架的必要部分,既不该夸大也不该低估其作用;公开记录企业风险缓解举措、恶化的问题和真正有效的防护措施,能推动听证、立法和行业规则,也让关键决策民主化。
「漫话AGI」频道最新
- 模型安全测试或成第三算力维度,作者称 NVIDIA 正抢监管先机 — JOBhakdi · 2026-09-27
- 「AI 疲劳」如同 2000 年代初的「互联网疲劳」,回避者终将被甩下 — pattyneta · 2026-09-27
- Nate Silver:AI 是 40 多岁人群的大红利 — soumitrashukla9 · 2026-09-27
- Agentic AI 已取代 DevOps?开发者嘲讽引争论 — emeka_boris · 2026-09-27
- AI 写的代码谁来审?人类评测能力正成关键瓶颈 — xx_HeckinChonker_xx · 2026-09-27
- Gary Marcus:若中国 AI 做 OpenAI 此事,舆论早炸锅 — GaryMarcus · 2026-09-27