CDRL 论文:结合符号推理加速中微子模型发现
DanielWhiteson · x · 2026-08-26
Piyush Jha 等人提出了“认证驱动强化学习(CDRL)”框架,用于解决科学发现中的组合假设空间搜索问题。该框架利用符号推理工具提供的结构化反馈,将违反约束的证书转化为可复用的约束条件,从而引导智能体避免无效探索。在中微子味模型发现任务中,CDRL 在三个理论空间中实现了最高 1.95 倍的有效模型率,并减少了候选评估次数。
「研究」频道最新
- SAP 十亿美元收购 Prior Labs,TabPFN 主创访谈 — ziv_ravid · 2026-08-26
- 大英百科全书 1768-1929 年 11.5 万页插图数据集开源 — vanstriendaniel · 2026-08-26
- 研究:GLM 5.2 在不同 API 提供商处性能表现惊人一致 — niloofar_mire · 2026-08-26
- Anthropic 研究员将开讲:Claude 的 J 空间与机器意识 — PeterBowdenLive · 2026-08-26
- 研究称 Agent 框架对分数影响大于模型本身 — rohanpaul_ai · 2026-08-26
- NeurIPS 2026 设「可解释性作为科学」研讨会,探讨 LLM 理解的严格基础 — ninamiolane · 2026-08-26