RLM 递归语言模型:让 LM 在 REPL 中递归调用自己处理超长上下文

gordic_aleksa · x · 2026-09-20

RLM(Recursive Language Model)是一种推理策略:语言模型可把输入上下文当作外部数据编程操纵,并对其中选定部分递归调用自己或其他 LLM。

与常规 coding agent 的关键区别在于:全部输入和中间结果都存放在外部 Python REPL 中,根 LM 只决定执行哪些计算,从而缓解 context rot。

工作流程示例(从 5k 条数据中统计特定用户的 entity 问题数):

作者还指出最关键的一点:可以在此 harness 内对根 LM 做 RL 后训练——在这一抽象层级上许多问题结构相似,泛化效果显著更好。工作出自 Alex L. Zhang 与 lateinteraction。

所属事件:RLM 递归语言模型发布:GPT-5-mini 长上下文答题数超 GPT-5 两倍(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →