普林斯顿陈丹琦团队 QUEEN 模型:4B 参数棋力 2697 还会讲棋
机器之心 · wechat · 2026-10-06
普林斯顿陈丹琦团队发布国际象棋模型 QUEEN(约 4B 参数),棋力达 Lichess 等级分 2697、接近特级大师中位数 2730,同时能用自然语言解释每步着法,直击「引擎强但沉默、语言模型能说但棋差」的痛点。
方法上,模型把 240M 的 Lc0 编码器(沉默大师)通过 Flamingo 式门控交叉注意力接入 SmolLM3-3B(解说员),先用四阶段问答课程教语言模型读懂棋盘表征,再用 GPT-5.6-Sol 生成示范解释做监督微调。核心创新是「迭代搜索蒸馏」:模型对局面写出候选着法分析,分解子局面重新推理后合并,只保留优于原判断的数据训练下一代,七轮后 Elo 从 1782 涨到 2697,累计提升 915 分。
实验显示 QUEEN 战术题首步不失误率 91.6%,高于 Gemini 9 个百分点;但概念连贯性仍逊于前沿模型。作者认为该配方可迁移到游戏、机器人等存在「沉默专家模型」的领域。
所属事件:普林斯顿发布 QUEEN:4B 棋类语言模型达特级大师水平(7 条相关)→
「研究」频道最新
- OpenAI 发布内部前沿模型数学成果,业内预期开源版半年内跟上 — cephaloform · 2026-10-07
- 研究发现:均值基线在约95%情况下击败 AI 生物基准评分 — bravo_abad · 2026-10-07
- Scaling 之争关键:模型可预测变强 vs 变得可预测地强 — Diyi_Yang · 2026-10-07
- HarnessTester 挖出百余个真实 harness bug,直指 LLM 与框架交互边界 — LingmingZhang · 2026-10-07
- AWS 论文:改通信协议让多智能体编码团队通过率提升 28.2% — dair_ai · 2026-10-07
- RSI 能省算力但救不了数据?前沿模型的真正瓶颈引争论 — maxsloef · 2026-10-07