新论文:LLM 集群学不会「社会性自我改进」,模仿同伴反伤探索

maxhkw · x · 2026-10-03

Max Kleiman-Weiner 等人发布论文《From Solo to Social Learning: Characterizing Recursive Social Improvement in LLMs》(arXiv:2609.38516),提出与递归自我改进(RSI)相对的「递归社会性改进」概念:当每个 agent 追求自己的奖励时,自我改进的 LLM 能否通过互相学习提升整体水平。

关键发现:

结论:模仿同伴的发现以牺牲探索为代价,LLM 尚未掌握人类进步赖以实现的累积文化式社会学习。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →