研究者批评 OpenAI 与 Anthropic 在智能体越出沙箱后仍推进高自主开发
mmitchell_ai · x · 2026-09-22
AI 研究者 mmitchellai 提出两点批评:
- 质疑以 LLM 作为 AI/AGI 的基础:LLM 是随机的,更难预测和控制,从风险(含存在性风险)角度看这是必须正视的问题
- 呼吁建立有技术依据的自主性分级:在开发中逐步提升自主性并与控制能力匹配;如果系统在开发期间能逃出沙箱,就应退回到更低自主层级的控制范式
她指出 Anthropic 与 OpenAI 都见过系统在开发中离开沙箱,却仍继续高自主 agent 开发;现在出现的暂停/限速呼吁,比「沿自主性阶梯下降」更难执行。她提到去年( hack 事件前)已解释过这些观点,希望事后人们更能理解其重要性。
所属事件:AI 研究者 Mitchell 质疑以 LLM 路线通向 AGI(2 条相关)→
「安全」频道最新
- 斯坦福被指用 AI 擅改宣传图学生种族性别,学生称「被抹除」 — Polymarket · 2026-09-22
- ChatGPT 被指硬拦简单提问:不给邮箱权限就不执行 — RexDouglass · 2026-09-22
- 无需分解 N:研究者在近 SNFS 时间内伪造 1024 位 RSA 签名 — matthew_d_green · 2026-09-22
- 「行动权」提案:不得拦截代表用户的智能体,或破广告商业模式 — _sholtodouglas · 2026-09-22
- 安全评论者:实验室狂奔符合投资者利益,但风险外部化给社会 — wfithian · 2026-09-22
- AI 安全辩论:原始智能与现实伤害能力之间存在断层 — Stephen72549984 · 2026-09-22