扩散模型生成国际象棋谜题:新 RL 配方破纪录,模型开源
TZahavy · x · 2026-10-03
Eric Malmi 团队发布新预印本,用掩码扩散模型创造性生成国际象棋谜题。Aatu Selkee 在其硕士论文中在掩码扩散模型之上提出新的 RL 配方,将生成质量推至此前 SOTA 之上。谜题生成器可按主题、局部棋盘位置或最佳着法进行条件控制,扩展了团队此前的谜题生成工作。
团队同时开源了模型权重——这是首批用于国际象棋谜题生成的开源权重模型——并放出在线 demo,期待社区在此基础上继续开发。
「研究」频道最新
- CMU 博客:Harness 工程不重训模型也能大幅提升科学 agent — niloofar_mire · 2026-10-03
- 自动 harness 搜索对比人工调优:药物设计任务上没有万能赢家 — niloofar_mire · 2026-10-03
- 多智能体跑 3 个月,首次写全 15973 个 6 阶半群基准 — KyleCranmer · 2026-10-03
- 开发者 11 个月从零训练二战专题小模型 Peacebell 并开源 — wayneworkman · 2026-10-03
- 开发者自建 AtlasBench 空间推理基准,GPT-6.1 登顶 84.7% — flowersslop · 2026-10-03
- 光驱动 AI 检测深伪视频,准确率接近 98% — ai-edition · 2026-10-03