Hazy 研究:MLP 可在初始化时注入知识供 Transformer 调用
andrew_n_carr · x · 2026-07-23
这条帖子提到一项 Hazy 的研究:MLP 可以在初始化时就被“塞入知识”,不需要先训练;而且只要方法得当,Transformer 还能调用并使用这些知识。
作者把它理解为对持续学习的一种启发:知识未必只能靠梯度下降慢慢学出来,也可能在初始化阶段就以某种形式写进网络结构里。
所属事件:HazyResearch 提出无需训练直接写入大模型知识的新方法(5 条相关)→
「研究」频道最新
- MaP-WAM 用记忆驱动规划攻克非马尔可夫机器人操作难题 — Sizhe Zhao · 2026-09-11
- 负向自蒸馏:让模型靠避开错误推理学会更好的推理 — Rongcan Pei · 2026-09-11
- NBER 经济学论文约 24% 含 AI 生成文本,2025 年起激增 — JeremyNguyenPhD · 2026-09-11
- DeepMind 等论文:设计文档当真相源,代码改为可抛弃产物 — Roger_M_Taylor · 2026-09-11
- GameWorld 获 ECCV 2026 多模态数字代理研讨会最佳论文亚军 — MikeShou1 · 2026-09-11
- Yann LeCun 在 ECCV 直播开讲世界模型 — Weak_Assistance_5261 · 2026-09-11