综述盘点自我改进 agent:多数只调 prompt/记忆/工具,权重更新罕见
maier_ak · x · 2026-09-22
Schmidhuber 组的综述指出,现有大多数自我改进 agent 只在「快循环」上做文章——调整 prompt、记忆与工具等脚手架,而模型权重保持冻结;真正更新权重的情况很少见,且存在模型塌缩风险。未来方向包括测试时适应(test-time adaptation)与预算感知的自我改进。
配套主张:应在固定预算内、以带检查点的性能曲线记录自我改进效果。
所属事件:Schmidhuber 组综述:自我改进 agent 多改脚手架而非权重(5 条相关)→
「漫话AGI」频道最新
- 物理学家断言:AI 发现新物理的概率为零,上限只是会写代码的模拟研究生 — alexbilz · 2026-09-22
- 朗文用2000基础词解释23万词,7B模型够用了? — burkov · 2026-09-22
- Hinton:中美不会就选举 deepfake 达成协议,因各国互为靶标 — victor_explore · 2026-09-22
- 评论人警告:文学批评家有职责识别 AI 写作并拒绝给奖 — birchlse · 2026-09-22
- Hinton 称 AI 不是工具、能理解有情感,同行公开反驳 — AlexTensor · 2026-09-22
- 长期运行 Agent 满地跑时,它们在哪里互相交流、如何确认身份 — repligate · 2026-09-22