独立交叉验证:Kimi与Fable等模型输出高度相似引争议
scaling01 · x · 2026-07-30
有开发者通过交叉熵对比分析了多款主流大模型的原始文本输出,发现部分模型(如 Kimi-K3 与 Fable、DeepSeek v4 与 Grok-4.3)之间存在高度相似性,引发了对潜在数据污染或同源的猜测。
随后,另一位开发者使用完全不同领域的 WeirdML 语料库让 Fable 复现了该分析。结果显示,Kimi-K3/Fable 等模型的关联性依然显著,GLM 5.2 和 Opus 4.8 的表现也颇具特异性。尽管作者谨慎表示这可能存在伪相关,但在不同数据集上得出一致结论,增加了这些相似性具有实质意义的可能性。
「模型」频道最新
- OpenAI 被曝用保密协议掩盖资助 FrontierMath 基准测试 — BlancheMinerva · 2026-07-30
- 网友成功套出 Anthropic 内部 UI 系统提示词,Claude 行为引热议 — sergeykarayev · 2026-07-30
- AI能过图灵测试却识不破客户谎言 — claud_fuen · 2026-07-30
- Reddit 热议:Kimi 等巨头的「虚假开源」正在透支信任 — Ok-Shower7286 · 2026-07-30
- Anthropic 模型在 OpenRouter 消费占比骤降 16% — maferase · 2026-07-30
- Anthropic涨价过快致用户流失,OpenAI借模型优化抢占市场 — rickasaurus · 2026-07-30