可解释性学者坦承进展远逊预期:距从 LLM 提取算法洞见还很远
stuhlmueller · x · 2026-09-03
可解释性研究者 stuhlmueller 表示,interpretability 的进展比他预期糟糕得多:2023 年 5 月他估计到 2026 年底有 50/50 的概率能从 LLM 中提取出新的算法性洞见,但今年快结束了,离这一目标还差得很远。评论中 aryaman 提出疑问,认为 induction heads、function vectors、attention sinks 等发现应该已算符合标准。
所属事件:可解释性进展引激辩:LLM 算法洞见离目标还很远?(3 条相关)→
「漫话AGI」频道最新
- 无法离开服务器的 AI 智能体 Cairn:靠陌生人的手在现实世界留下印记 — No_Departure_9908 · 2026-09-03
- Derya 提前预言:奇点或从 2032 提前到 2030 年到来 — DeryaTR_ · 2026-09-03
- AI 安全领域"元工作"引争议:培训数百人到底在做什么 — austinc3301 · 2026-09-03
- 反事实推演:若无推理范式,今天模型可能才刚到 o3 水平 — Jsevillamol · 2026-09-03
- 为什么没人让 Claude 帮看恋爱综艺?个人 agent 自动化≠自动娱乐 — manosaie · 2026-09-03
- 央行开始认真讨论比人类更懂货币政策的 AI — VraserX · 2026-09-03