Locus 自动后训练系统用数千 H100 小时跑赢人工调优 Qwen3
_akhaliq · x · 2026-08-04
Locus 通过更多 H100 算力把自动后训练做到了更强
这条内容介绍了一个名为 Locus 的自动化 AI 研究系统:它在 PostTrainBench 上拿到 SOTA,并且在扩展后的 PostTrainBench+ 上展示出明显的算力扩展收益。
- 作者将基准的计算预算大幅提高,以更清楚地区分不同自动后训练方法的能力。
- 在 Qwen3 1.7B-Base 上,随着算力提升到数千个 H100 小时,Locus 训练出的模型整体表现甚至超过了官方人工后训练的 Qwen3 1.7B。
- 他们还把系统放到真实的 Kaggle 竞赛里测试泛化能力。
- 帖子称,Locus 端到端后训练的 LLM 已经进入面向数百万用户的生产环境。
「研究」频道最新
- 论文草稿称 Erdős–Simonovits 退化度猜想在 r≥2 全部失效 — ctjlewis · 2026-08-04
- Athena Crisis 用路径寻路和 k-means 做出游戏 AI — cnakazawa · 2026-08-04
- Bittensor 子网 107 称与 OpenAI 共写代理式科学计算报告 — markjeffrey · 2026-08-04
- 人形机器人用 real→sim→real 闭环实时跨越未知地形 — chris_j_paxton · 2026-08-04
- Harry Stebbings 称其最坦诚 AI 访谈谈了开源模型、中美与网络安全 — arena · 2026-08-04
- NVIDIA 在 NeMo Gym 中加入 Legal Agent Bench,含 1,749 个任务与办公文件技能 — NVIDIAAI · 2026-08-04