SOOFI 更新报告仍被指评测污染,Nemotron 3 Nano 可能还更强
JJitsev · x · 2026-07-26
作者指出,更新后的 SOOFI 报告仍然在误导读者:
- 报告把 Nemotron 3 Nano 标成了“open-weights”,但作者强调它的数据与训练栈本来就是开放的。
- SOOFI 继续用存在 eval leakage / contamination 的分数,支撑自己“frontier-level champion”的说法。
- 关键结论是:即便多训练了 2T tokens,SOOFI 目前也未必真的超过原始 Nemotron 3 Nano。
所属事件:SOOFI 模型被指评测数据严重泄漏,对比 Nemotron 失去公平性(9 条相关)→
「模型」频道最新
- “5.6 Pro”被指在数学型任务上胜过 Fable 5 — MParakhin · 2026-07-26
- Claude 写 Opus 5 批评时总在替它辩护 — sethlazar · 2026-07-26
- Unsloth 的 Qwen3.6-35B-A3B GGUF 在 HF 走红 — unsloth · 2026-07-26
- SOOFI 多训练 2T tokens 后,仍可能只是追平 Nemotron 3 Nano — JJitsev · 2026-07-26
- 让 Claude 先追问澄清,能直接挖出遗漏前提 — Commercial-Most3081 · 2026-07-26
- 用户称 Claude Opus 5 比 GPT-5.6 Sol 更有常识感 — dejavucoder · 2026-07-26