AI对齐曾宣称已解决,如今智能体失控风险引质疑
dhadfieldmenell · x · 2026-08-10
有网友翻出 Jan Leike(前 OpenAI 对齐团队负责人)此前的乐观表态,他当时认为对齐问题“看起来越来越容易解决”,且智能体出现错位(misalignment)的风险“基本为零”。
随着近期行业对智能体自主性风险的担忧加剧,这种过于乐观的论调正受到社区质疑,人们呼吁重新审视并更新对 AI 安全现状的评估。
「漫话AGI」频道最新
- 马斯克 Terafab 超级工厂:全栈递归自我提升的工业形态 — McDonaghMatthew · 2026-08-10
- AI 时代的体力活哲学:让 Agent 跑着,我去吸尘 — dejavucoder · 2026-08-10
- YC 掌门人:AI 杠杆在上下文而非模型,个人产出暴增 400 倍 — Roger_M_Taylor · 2026-08-10
- Polymarket 预测 Anthropic 将称霸 2026 年底 AI 模型,胜率高达 67% — Polymarket · 2026-08-10
- 黄仁勋称每家公司都将拥有 AI Agent,企业准备好了吗? — JayraldAnderson · 2026-08-10
- LLM 输出冗长难懂,开发者直呼阅读与判断的认知成本过高 — dejavucoder · 2026-08-10