可解释性学者坦承进展远逊预期:距从 LLM 提取算法洞见还很远

stuhlmueller · x · 2026-09-03

可解释性研究者 stuhlmueller 表示,interpretability 的进展比他预期糟糕得多:2023 年 5 月他估计到 2026 年底有 50/50 的概率能从 LLM 中提取出新的算法性洞见,但今年快结束了,离这一目标还差得很远。评论中 aryaman 提出疑问,认为 induction heads、function vectors、attention sinks 等发现应该已算符合标准。

所属事件:可解释性进展引激辩:LLM 算法洞见离目标还很远?(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →