德语数据与评测让对比失真

JJitsev · x · 2026-07-16

这条回复在纠正一项德语模型对比中的表述:应是“优于 Nemotron”,而不是“对 Nemotron”。作者认为,Soofi 本身拥有更多德语训练数据,就已经会对 Nemotron 形成明显优势。

同时,若再把“德语重写后的评测”也纳入比较,那么用这些评测去证明 Soofi 相对 Nemotron 的强弱就变得不成立,因为评测本身已经被训练数据或语言处理方式影响,比较结论会失真。

所属事件:SOOFI 评测泄漏与基线对比争议(13 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →