ICML 可解释性工作坊:AI safety 该先研究认知、信念和目标
gabepgomes · x · 2026-07-26
- Eric Michaud 认为,如今很多 AI safety 讨论的核心问题——系统是否对齐、它的价值观是什么、它“在地球上的目的”是什么——其实都缠绕着更基础的问题:AI 系统如何认知、它们的信念与目标究竟是什么。
- 他警告说,如果不先处理这些基础层面就急着跳到更高层的对齐问题,领域很容易继续“乱冲”,带来混乱、停滞,也会偏离务实目标。
- 这条帖子指向他在 ICML 机制可解释性工作坊上的 lightning talk 博文版。
「漫话AGI」频道最新
- 开源模型终将无处不在,政策恐吓也拦不住 — GabGarrett · 2026-07-26
- 数学并不是阻止普通人用 AI 的清晰边界 — RexDouglass · 2026-07-26
- 新的职场身份标志,成了公司愿意给你买多贵的模型 — rickasaurus · 2026-07-26
- AI safety 圈争论:在业界工作还担心风险是否自洽 — max_paperclips · 2026-07-26
- 1171 个岗位拼出 OpenAI 和 Anthropic 的 AGI 路线图 — imjustnewatai · 2026-07-26
- “海德格尔式 AI 严重缺钱”:一条梗帖配上德雷福斯经典批评 — teortaxesTex · 2026-07-26