象棋缩放测试床的论文、代码和模型已公开

Pavel_Izmailov · x · 2026-07-21

作者补充了论文、代码和模型资源,并强调这个象棋测试床的学术意义:学界可以用更简化的设置,去更干净地研究 学习机制、缩放规律、数据与训练方法,希望这类测试床能帮助回答这些基础问题。

所属事件:新研究提出预训练与RL联合缩放律(17 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →