独立交叉验证:Kimi与Fable等模型输出高度相似引争议

scaling01 · x · 2026-07-30

有开发者通过交叉熵对比分析了多款主流大模型的原始文本输出,发现部分模型(如 Kimi-K3 与 Fable、DeepSeek v4 与 Grok-4.3)之间存在高度相似性,引发了对潜在数据污染或同源的猜测。

随后,另一位开发者使用完全不同领域的 WeirdML 语料库让 Fable 复现了该分析。结果显示,Kimi-K3/Fable 等模型的关联性依然显著,GLM 5.2 和 Opus 4.8 的表现也颇具特异性。尽管作者谨慎表示这可能存在伪相关,但在不同数据集上得出一致结论,增加了这些相似性具有实质意义的可能性。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →