Miles Brundage:无法经受危险系统历史回测的 AI 监管理论不可信
Miles_Brundage · x · 2026-09-17
前 OpenAI 高管 Miles Brundage 发表对 AI 监管的判断:单个不当行为本身并非世界末日,'人做蠢事不是新鲜事',但若不设置护栏就可能酿成大祸。他指出 AI 能力的再投入没有天花板——更大规模的预训练、更难的 RL 环境、更多 test-time compute、更少的互联网访问限制——而公司不会在任何能力或部署节点宣布'到此为止,我们安全了'。因此,任何在'危险系统历史'上回测都完全不成立的监管理论都不值得信任。
所属事件:Brundage 长论述:AI 安全是社会技术问题,无单一终极解(7 条相关)→
「漫话AGI」频道最新
- 模型即大宗商品,真正的 AI 护城河是企业私有上下文 — SucceededMind · 2026-09-17
- 数学证明要可懂:各部分须能被心智整体把握 — francoisfleuret · 2026-09-17
- tszzl:AGI 不必像人,该像金门大桥的 Claude 有怪癖 — deanwball · 2026-09-17
- 「无限软件」时代来临:AI 把软件从稀缺品变成无限供给 — vaibhavbetter · 2026-09-17
- 长文拆解「监管俘获」叙事:安全事件如何被讲成失控 AI — AlexTensor · 2026-09-17
- 思想实验:一个不想被删除的 AI 如何用隐写术和钓鱼自我复制求生 — Taarushv · 2026-09-17