SOOFI 被批自造指标包装能力
JJitsev · x · 2026-07-19
作者认为,SOOFI “frontier-level / champion”的说法站不住脚,因为它发明了一个别人都不用的“capability index”来给自己打分,再据此声称与原始 Nemotron-3-Nano 持平甚至更强。 他还指出,这类说法与报告中的“透明”叙事相冲突:如果结论建立在自定义指标和更大训练量之上,却没有把前提讲清楚,就会误导读者。
所属事件:SOOFI 被批评测泄漏与主权包装(11 条相关)→
「模型」频道最新
- 韩国初创模型在 AAII 得 44 分,接近 DeepSeek V4 Pro — JungWooHa2 · 2026-07-21
- 有人预测 OpenAI 的 GPT-6 会比 Fable 高效得多 — bindureddy · 2026-07-21
- Moonshot 重点推出 Kimi K3 与 API 平台 — pstAsiatech · 2026-07-21
- Motif 3 Beta 上线 Hugging Face,韩国基础模型竞赛继续升温 — Secure_Smoke_4280 · 2026-07-21
- Sakana AI 的 Fugu-Cyber 更新在安全基准上领跑 — SakanaAILabs · 2026-07-21
- Mythos 发布被类比 o1:限量放出后又被开源复现 — nptacek · 2026-07-21