AI 学者呼吁将模型自我编辑代码划为安全红线
Google 研究科学家 Margaret Mitchell 在关于「Pacing AI」的讨论中提出,应在「自我代码编辑」成为大问题之前就划下红线,将其直接排除在 AI 能力之外。随后有回应者以 iPhone 家长控制作类比,主张 AI 安全护栏不仅应限制下载新应用,也要像锁死系统般严格约束模型自我改码行为。
2026-09-18 ~ 2026-09-18 · 2 条相关
- Margaret Mitchell 预警:模型自我编辑代码应被彻底禁止 — mmitchell_ai · 2026-09-18
- 回应对齐学者:模型自我改码应成红线,像 iPhone 家长控制一样锁死 — BecauseCulture · 2026-09-18