帝国理工实验室已原型化潜在 tokenization 与可学习自适应记忆
PontiEdoardo · x · 2026-09-11
Edoardo Ponti 补充介绍其实验室的研究方向:已在 decoder 中原型化潜在 tokenization(latent tokenization)和可学习的自适应大小记忆(adaptive-size memory)。下一步计划是把这些方法规模化并继续改进,同时探索它们在推理时超扩展(hyper-scaling)和长视野世界建模中的应用。该帖是其 AToM 项目招聘线程的一部分,团队已在 Qwen3-8B-DMS-8x 与 Bolmo-7B 上做出改造原型。
所属事件:帝国理工 ERC 项目 AToM 招博士后与博士(2 条相关)→
「研究」频道最新
- 果蝇大脑连接组交易比特币一天半,收益 4.32% 跑赢机器学习模型 — johnseach · 2026-09-12
- ICLR 2026 论文 MoM:混合多记忆状态破解线性模型召回短板 — kastnerkyle · 2026-09-12
- 哈佛研究员用果蝇大脑连接组交易比特币,1.5 天跑赢 ML 模型 — Scobleizer · 2026-09-12
- 8 个 LLM 与 1.8 万人对比:模型会做难题却常缺失基础知识结构 — rohanpaul_ai · 2026-09-12
- 88 题自改进基准 RSI-Exam 开放 35 题,被看好接棒 SWE-bench — cihangxie · 2026-09-12
- ETH Zurich 等发布 SuperFlex:可变形超二次曲面分解点云,比 Marching Primitives 快万倍 — orlitany · 2026-09-12