SOOFI 多训练 2T tokens 后,仍可能只是追平 Nemotron 3 Nano
JJitsev · x · 2026-07-26
作者认为,SOOFI 更新后的数据仍不足以证明它追平了 Nemotron 3 Nano:
- 问题仍是 benchmark contamination,报告用受污染的分数包装结论。
- 即便比 Nemotron 3 Nano 多训练了 2T tokens,SOOFI 也可能只是打平。
- 这条帖子的核心判断是:所谓“frontier-level champion” 仍缺乏公平对比支撑。
所属事件:SOOFI 模型被指评测数据严重泄漏,对比 Nemotron 失去公平性(9 条相关)→
「模型」频道最新
- “5.6 Pro”被指在数学型任务上胜过 Fable 5 — MParakhin · 2026-07-26
- Claude 写 Opus 5 批评时总在替它辩护 — sethlazar · 2026-07-26
- Unsloth 的 Qwen3.6-35B-A3B GGUF 在 HF 走红 — unsloth · 2026-07-26
- 让 Claude 先追问澄清,能直接挖出遗漏前提 — Commercial-Most3081 · 2026-07-26
- 用户称 Claude Opus 5 比 GPT-5.6 Sol 更有常识感 — dejavucoder · 2026-07-26
- 前沿模型生物幻觉少了,却更爱乱用术语 — owl_posting · 2026-07-26