研究者拟建“研究品味”Benchmark:挖掘选题直觉
lateinteraction · x · 2026-08-18
一组研究者正在发起一项新计划,旨在建立一个名为“研究品味”的 Benchmark。目标是通过汇聚社区知识,捕捉那些未被记录的“哪些前人工作值得在此基础上继续构建”的决策过程。由于担心预训练数据会包含这些共识,该项目具有时效性。组织者呼吁近期发表论文的研究者参与注册,目前估计全球有至少 1 万名符合资格的作者。
「研究」频道最新
- HUI360:100万样本的机器人交互预测数据集发布 — jonstephens85 · 2026-08-18
- AI 自动化系统赢得内核优化竞赛第三名 — iScienceLuvr · 2026-08-18
- 新论文重构 Agent 技能协议:解耦内容与触发 — Zachly · 2026-08-18
- DeepSeek 推出 LibTorch ABI 稳定版 FlashMLA — ezyang · 2026-08-18
- 实验:控制规则能否阻止 LLM 无据决策? — Plastic-Cell-4497 · 2026-08-18
- Mechanist 论文探索用 AI 发现智能机制 — ruthstarkman · 2026-08-18