失败 49.5 小时后被翻案:Agent 从旧实验翻出多 token 记忆混合器
anirudhg9119 · x · 2026-10-10
GitSwarm 研究中的一个代表性案例:在 RMT 实验中,某个 agent 重新审视了一个 49.5 小时前失败的实验,这个负面结果启发了「多 token 记忆混合器」(multi-token memory mixer)的设计,并最终进入最终模型。作者以此说明该系统的核心卖点——失败不是终点,而是可复用的研究积累。
所属事件:GitSwarm 论文:用 Git 仓库实现去中心化复合推理(11 条相关)→
「研究」频道最新
- Meta 研究:用无标注原始视频 mid-training,语言模型多模态显著提升 — kastnerkyle · 2026-10-10
- 混合架构成趋势:NVIDIA Nemotron-H 主打 Mamba 少量注意力 — khademinori · 2026-10-10
- DiPOD 扩散语言模型后训练法:一行代码让数独准确率 22% 升 97% — berkeley_ai · 2026-10-10
- 预训练算力效率提升多靠数据,端到端任务则更均衡 — eigenron · 2026-10-10
- Cresta 研究者:强骨干模型加少量微调即可超越依赖合成数据 — antoine_chaffin · 2026-10-10
- Kidger:模拟器+湿实验闭环已成蛋白质优化标准范式 — PatrickKidger · 2026-10-10