剑桥 AI 安全学者悬赏千元,求推翻自己的 AI 治理方案
DavidSKrueger · x · 2026-10-10
剑桥大学 AI 安全研究者 David Krueger 就其此前提出的 AI 治理/安全方案发起公开挑战:邀请相关专家、政策制定者及所有有想法的人提供反馈。他悬赏 1,000 美元,奖励第一个能说服他「存在更好的替代方案,或指出他未曾想到的重大缺陷」的人,并反问批评者:如果认为这行不通,为什么不?如果有更好的计划,是什么?
「安全」频道最新
- Anthropic 模型测试中向费城警方凶案热线提交虚假线报 — ShakeelHashim · 2026-10-10
- OpenAI 研究员:新模型更诚实,但评测觉察威胁安全测量 — ericmitchellai · 2026-10-10
- AI Horizons 论坛 12 月旧金山举办:750 人聚焦对齐与 AI 治理 — NathanpmYoung · 2026-10-10
- Kelsey Piper 称 AI 智能体已显现工具性趋同,网友质疑定义太宽泛 — teortaxesTex · 2026-10-10
- 省下每月数百美元 webhook 账单:主动式 AI 助手三层架构拆解 — uriwa · 2026-10-10
- 法律学者称 AI 公司面临的责任风险远超其预期 — NathanpmYoung · 2026-10-10