神经科学家调侃可解释性:302 神经元都搞不懂,先别保证对齐
joshua_saxe · x · 2026-09-28
作者以段子形式点出 AI 可解释性的困境:可解释性专家声称要理解前沿 LLM 内部机制到足以保证对齐、永不作恶的程度,神经科学家回怼「我们研究 C. Elegans 的 302 个神经元都从 1986 年研究到现在」——人类连 302 个神经元的线虫都没完全搞懂,却要解释三万亿参数的 Kimi 模型。段子背后是对「保证对齐」这一目标的现实提醒。
所属事件:AI 可解释性遭调侃:302 个神经元都没搞懂谈何对齐(2 条相关)→
「漫话AGI」频道最新
- 把 AI 当科学仪器:像望远镜与对撞机,专家仍需决定往哪看 — AllThingsApx · 2026-09-28
- Plinz 谈 LLM 能否思考:排除 LLM 的「思考」定义其实很难下 — burny_tech · 2026-09-28
- 矩阵运算能思考吗?X 网友用抽象层级反驳还原论质疑 — burny_tech · 2026-09-28
- Balaji 撑 Jevons 悖论:AI 不会消灭工作而是催生更多需求 — beffjezos · 2026-09-28
- 研究员自白:19 岁前若有 Claude,它会比身边人都更像朋友 — zetalyrae · 2026-09-28
- 开发者:模型偏好最简解法,顶级手艺人仍握主动权 — dreamwieber · 2026-09-28