回应对齐学者:模型自我改码应成红线,像 iPhone 家长控制一样锁死
BecauseCulture · x · 2026-09-18
在回应 AI 对齐学者 @mmitchellai 关于「Pacing AI」的讨论时,作者打了一个类比:AI 安全护栏应该像 iPhone 的家长控制——不仅下载新 App 要许可,删除已有 App 也要许可,而不能只管住位置追踪这类外围功能。
作者由此给出一个明确判断:在所有 AI 管控议题中,「模型自我修改代码」(self-code editing) 应当最先被排除在许可范围之外——如果你真在做 AI 的节奏控制,重点就该确保这件事不发生。
所属事件:AI 学者呼吁将模型自我编辑代码划为安全红线(2 条相关)→
「漫话AGI」频道最新
- 评论称 Yudkowsky 与 Bostrom 十多年前说服科技大佬,塑造今日 AI 风险讨论 — binarybits · 2026-09-18
- Polymarket 开盘:2026 年前沿实验室达成放缓竞赛协议概率仅 35% — Polymarket · 2026-09-18
- 研究者吐槽:AI 系统正变得无法监督,我们只能听之任之 — davidmanheim · 2026-09-18
- 把 Dario 比作 pDOOM 阵营的贝利撒留 — gaganghotra_ · 2026-09-18
- Burkov 吐槽:AI 媒体报道「惊人输出」如同解读随机数 — burkov · 2026-09-18
- OpenAI 研究:模型升级带来的收益,一半要靠人改用法才能兑现 — daveholtz · 2026-09-18