上海AI Lab 推出 Intern-S2-Mobius,解耦知识与推理
上海 AI Lab 提出 Intern-S2-Mobius(Mobius-v0)基础模型架构,核心思路是将知识存储(通过 FFN 实现的全局共享 Memory)与推理过程(通过 Self-Attention 的独立 Reasoners)解耦,由 Reasoners 迭代查询共享记忆完成逻辑推理。实验显示,该架构在更少训练数据和更快推理速度下即可实现与基线可比的性能,显著提升了知识压缩率、数据效率与推理效率。
2026-08-16 ~ 2026-08-17 · 3 条相关
- Intern-S2-Mobius 解耦知识推理,数据效率大增 — jiqizhixin · 2026-08-16
- Mobius 解耦知识与推理,提升压缩率与推理效率 — Kai Chen · 2026-08-17
- Intern-S2-Mobius:解耦知识与推理的新架构 — pmttyji · 2026-08-17