COLM 2026 现场:研究员探索通用一次性 Agent 与演化知识库的 RSI 新范式

yisongyue · x · 2026-10-07

研究者薛飞在 #COLM2026 期间分享其近期工作:一种新的递归自我改进(RSI)范式,采用「通用、可丢弃的 agent + 可演化的知识库」组合;以及通过通信进行后训练(post-training via communication),让多个协作 LLM 在可变规模的组队中互相学习。他欢迎同样在探索 RSI、后训练或科学 agent 的研究者交流。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →