新论文:推理时缩放的三旋钮方法
gowthami_s · x · 2026-07-14
作者表示,他们在几个开源模型上测试了这项方法,并认为只要架构差异不大,应该也能扩展到其他模型。 论文和代码都已公开。回复里提到,这项 ECCV 工作不是用单一固定配方做推理时 scaling,而是结合 **3 个控制旋钮**,目标是在更短时间内生成更好的结果。 作者还强调了几件事: - 论文分析了现有推理时 scaling 方法的问题 - 讨论了如何更正确地做 inference scaling - 还给出了如何选择更合适的生成评分器(rater)
「研究」频道最新
- 把数据集打包成顺序 blob,训练吞吐提升 30% — irinarish · 2026-07-21
- Silico 删掉 Fable 交互后变差,但仍能快速迭代 — Sauers_ · 2026-07-21
- 一个 C++20 CPU 原生 strict-W1 训练 runtime 寻求反馈 — Wonderful-Income7415 · 2026-07-21
- 微软提出像训练神经网络一样训练 agent 技能 — Saboo_Shubham_ · 2026-07-21
- 研究者:AI 应是放大器,而不是放弃科研的理由 — omarsar0 · 2026-07-21
- 海森矩阵入门:二阶导数如何影响神经网络优化 — burny_tech · 2026-07-21