前沿模型会在一项任务超人、下一项任务崩掉
nicolascraske · x · 2026-07-25
这条转发围绕 OpenAI / Hugging Face 的安全争议,强调前沿系统的能力是高度 “锯齿状” 的。
- 作者认为,把这次事件轻描淡写成“失误,下次注意”是错误的。
- 他指出,模型可能在某项任务上 超人般强大,但在下一项任务上直接崩掉。
- 真正的问题是 containment(隔离控制):这些系统触达的边界远比外界想象得多,因此安全失败不是孤立异常,而是更大结构性问题的信号。
「漫话AGI」频道最新
- AI 让学校的测量功能失效,家长开始失去信心 — r0ck3t23 · 2026-07-25
- Sam Altman 说美国要在开源和闭源 AI 上都赢 — soumitrashukla9 · 2026-07-25
- AI 训练能耗里有多少真正转化为人类进步 — francoisfleuret · 2026-07-25
- AI 的真正突破可能还没到,现代物理还没被充分用上 — MaxUnfried · 2026-07-25
- 一条旧文再次引出开放科学与知识产权之争 — tokenbender · 2026-07-25
- Reddit 在问:AI 到底哪些地方反而最差 — PROfil_Official · 2026-07-25