Locus 在六场 Kaggle 竞赛中平均排第 4
mariofilhoml · x · 2026-08-04
这条转述强调了 Locus 不只是“后训练”场景工具,而是在更广泛的任务上也有表现,并且结果还和 PostTrainBench 作者一起做过核验。
核心信息是:他们把 Locus 不做任何专项配置、也不给每个竞赛单独写指令,直接跑在当时所有带公开排行榜、且有奖金的 Kaggle 竞赛上。结果显示,它在六场竞赛里的平均名次排到第 4,并且据称超过了 89.5% 的人类参赛者。引用里还提到,Locus 目前也被用于 量子化学 和 语音识别 等行业问题。
转发者同时提醒,这个“第 4 的平均名次”带有一定的营销式计算成分,但整体成绩仍然很强。
所属事件:自动研究系统 Locus 刷新后训练榜单(4 条相关)→
「模型」频道最新
- Hugging Face 上 4B 模型 Athena 称胜 GPT-5.6 和 Opus 4.8 — rohanpaul_ai · 2026-08-04
- DeepSeek V4 Pro 被指仍处早期,结果已开始公开 — teortaxesTex · 2026-08-04
- DeepMind 为何没再领跑数学基准,Reddit 讨论原因 — Full_Tangelo_7450 · 2026-08-04
- DeepSeek V4 Flash 0731 在 llama.cpp speculative decoding 里报 ctx_other 错 — Ambitious_Fold_2874 · 2026-08-04
- trydecideAI 完成 Dax-1 训练,主打确定性表格编辑 — saheedniyi_02 · 2026-08-04
- Kimi K3 在 69 项编码测试中领先,但 ML 流程错误仍常见 — mariofilhoml · 2026-08-04