HOPE 论文称其掩码可阻断灾难性遗忘,并留下新方向
TheGradient · x · 2026-07-24
这条是在总结 HOPE 相关研究的最后部分,重点不是观点闲聊,而是它的数学性质和后续开放问题。
- 作者指出,这套方法接下来可以继续扩展到更广的网络架构,或者研究“训练过程中动态增减网络规模”的场景。
- 他们强调,核心 mask 机制像一个单向阀:新知识不会反向流回去破坏底座,因此可以在数学上保证不会发生灾难性遗忘。
「研究」频道最新
- SHIFT 用重构机制把 LLM 变成高效检索器 — _reachsumit · 2026-07-24
- 腾讯提出面向推荐的离散扩散语言模型 — _reachsumit · 2026-07-24
- ICAE-Bench 把 coding agent 放进模糊需求做项目场景 — Zhongyuan Peng · 2026-07-24
- Predictive Divergence Masks 让 LLM RL 更新更贴近 trust region — Xiangxin Zhou · 2026-07-24
- 字节跳动用 10 万桌面场景数据集训练通用机器人操作 — ByteDance · 2026-07-24
- WorldWeaver 给多智能体视频扩散加上共享世界状态 — Sicheng Mo · 2026-07-24