DeepSeek-V4 Pro 与 Fable 任务相关性最低

zainhas · x · 2026-08-15

评测对比了 DeepSeek-V4 Pro、Fable 和 Sol 三个模型在任务上的行为相关性。数据显示,DeepSeek-V4 Pro 与 Fable 是多样性最高的一对(任务结果相关性仅 0.39),而 Pro 与 Sol 的行为最相似(相关性 0.54)。三模型组合未能解决的仅有 4 个任务。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →