JHU 分析 1100+ 模型:所有深度网络都收敛到同一个 16 维子空间
evolvingstuff · x · 2026-09-16
一条被广泛转发的推文称,Johns Hopkins 研究者分析了 1100 多个跨主要架构的训练模型,提出「通用权重子空间假设」:无论初始条件、训练数据或任务(写诗、驾驶、写代码)如何,深度神经网络都会收敛到同一个低维几何足迹——模型绝大部分「智能」集中在一个微小的共享谱子空间中,少数主方向控制一切。注意这是推文式的科普转述,具体论文细节与严谨性有待查证原文。
「研究」频道最新
- 论文:预训练语料中多谈对齐,错位率从 45% 降至 9% — TuhinChakr · 2026-09-16
- 仅 20 小时驾驶数据:1 名研究员用世界模型 Odyssey-3 教会 AI 在印度开车 — soleio · 2026-09-16
- AI 是否存在硬件彩票:Transformer 因适配 GPU 而胜出? — prateekj · 2026-09-16
- Every 团队测试产出概率而非文字的新型基础模型,快 25 倍成本仅 1/600 — danshipper · 2026-09-16
- Anthropic 实测自动化对齐研究员:Claude 智能体可缓解十类对齐失败 — echen · 2026-09-16
- MIT 绘制科学任务全景图谱:科研工作与经济任务大不同 — MIT_CSAIL · 2026-09-16