普林斯顿把 4B 模型练到国际象棋 2700 Elo,方法可迁移到机器人

Eliv_nurotic · reddit · 2026-10-06

普林斯顿研究者训练出一个 4B 参数 LLM,在国际象棋上达到 2700 Elo,且停止训练时仍无平台期迹象。更难得的是模型能准确解释自己的走法。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →