PaperGym:用强化学习生成科研计划
Yuhan Wang · hf · 2026-09-01
PaperGym 提出了一种以评估标准为中心的进化方法,用于生成研究计划。它通过将科学论文中的研究问题与评估标准分离,将论文转化为训练环境,从而实现能够改进跨多种模型规模研究规划的强化学习。
「研究」频道最新
- Matrix-Game 3.5:用 Patch Memory 增强实时流式世界模型 — Runjia Qian · 2026-09-01
- DreamX-Creator:7B 模型原生生成 2K 音视频 — GD-ML · 2026-09-01
- 字节发布 Lucida,支持可组合实到模拟场景建模 — ByteDance-Seed · 2026-09-01
- Qwen 团队发文解析 Qwen3.8-Next 架构设计 — Qwen · 2026-09-01
- Normalized LoRA 提升训练稳定性,不增推理成本 — Jiale Kang · 2026-09-01
- NeurIPS 2026 资源感知 Agent 研讨会征稿截止 — lupantech · 2026-09-01