Magic 公布下一步路线:长上下文 RL、潜在知识对齐,之后发布模型
magicailabs · x · 2026-09-09
Magic 在预训练研究更新后公布后续计划:
- 用长上下文扩展 RL,教会 agent 测试时学习(test-time learning)。
- 用「模型对自身意图的潜在知识」作为 RL 信号,追求更强的理论对齐性质。
- 继续改进预训练。
最后表示「当然,然后会把模型发布出来」。
所属事件:Magic 披露下一步路线并自称最小万亿参数模型团队(2 条相关)→
「模型」频道最新
- Blender 同题实测:两旗舰模型输出差距悬殊,训练数据分布是主因 — ZeroStateReflex · 2026-09-09
- Netlify 上线 GPT-6 Astra 等 3 款新模型,Agent Runner 智能改配额用法 — thisiskp_ · 2026-09-09
- GLM-5.3-Flash 登顶智能体工具调用榜首,输出仅 $0.50/百万 token — shensi · 2026-09-09
- Artificial Analysis 四天两次调榜,Astra 真实实力获认可 — py-net · 2026-09-09
- Gary Marcus 断言:真正的能力在 harness 而非模型,企业 beware 黑箱 — GaryMarcus · 2026-09-09
- Inception 发布 Mercury 2.5:最强扩散 LLM,1107 tokens/秒、26 万上下文 — StefanoErmon · 2026-09-09