研究者类比造桥与航空:AI 安全要靠理解机制而非人力盯防
ninamiolane · x · 2026-09-28
研究者 Nina Miolane 提出观点:每个成熟的工程学科都通过「科学理解」而非「人力监控」实现安全。桥梁安全靠预先计算载荷而非派人盯着,航空安全靠空气动力学成为科学,而不是雇更多人看飞机。她主张 AI 安全也应走同一条路——先建立能提前预测模型行为的科学规律(可解释性研究),再谈控制。她后续补充,自己正借助 Goodfire AI 的 Silico 平台做这类可解释性研究,认为理解内部表征是控制的前提。
「漫话AGI」频道最新
- DeepMind 三位高管合著:AGI 或以「智能体社会」而非单一超级大脑到来 — bratton · 2026-09-29
- AI 安全研究者:近期事故证明没有简单修复,只有不够强的缓解措施 — maksym_andr · 2026-09-29
- 游戏节宣布查出 AI 内容即永久除名,引开发者激辩 — AIandDesign · 2026-09-29
- Cantrill 撰文批 Hinton:AI 末日论错在越界下结论 — rms80 · 2026-09-29
- 生成式 AI 让写作和代码变廉价,但好判断力依然稀缺 — jacalulu · 2026-09-29
- AI 消灭杂活后,管理者开始怀念那些枯燥的重复劳动 — PAstynome · 2026-09-29