神经科学家调侃可解释性:302 神经元都搞不懂,先别保证对齐

joshua_saxe · x · 2026-09-28

作者以段子形式点出 AI 可解释性的困境:可解释性专家声称要理解前沿 LLM 内部机制到足以保证对齐、永不作恶的程度,神经科学家回怼「我们研究 C. Elegans 的 302 个神经元都从 1986 年研究到现在」——人类连 302 个神经元的线虫都没完全搞懂,却要解释三万亿参数的 Kimi 模型。段子背后是对「保证对齐」这一目标的现实提醒。

所属事件:AI 可解释性遭调侃:302 个神经元都没搞懂谈何对齐(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →