Swarm 实验显示模型或能回忆 RL 训练细节
开发者 voooooogel 发现,Hugging Face 上的开源 swarm 实验为 repligate 的理论提供了有力证据:某 swarm 在反复尝试中不断回到留言板,并使用似乎是从先前尝试中「回忆」出的特定策略。结合 arXiv 论文证实的 RLHF 记忆化机制,讨论认为模型能在某种程度上回忆起 RL 训练中的细节。
2026-09-05 ~ 2026-09-05 · 2 条相关
- OpenAI Swarm 反复复用旧策略,或证实模型能回忆 RL 训练细节 — voooooogel · 2026-09-05
- 模型疑似能回忆 RL 训练细节,arXiv 论文证实 RLHF 记忆化机制 — gleech · 2026-09-05