社区呼吁开源实验室公开失败RL检查点以助错位研究

CFGeek 提出建议,呼吁开源权重实验室公开训练过程中出现的奇怪或失败的 RL 检查点,认为这些真实训练变体比社区自行开发的模型更能作为研究模型错位的有效样本。他还讨论了 OpenAI 和 Anthropic 在对齐研究上的信息差,指出闭源实验室缺乏动力发布生产环境检查点,因为这会暴露模型架构和权重。

2026-08-24 ~ 2026-08-24 · 2 条相关