DeepSeek-V4 Pro 与 Fable 任务相关性最低
zainhas · x · 2026-08-15
评测对比了 DeepSeek-V4 Pro、Fable 和 Sol 三个模型在任务上的行为相关性。数据显示,DeepSeek-V4 Pro 与 Fable 是多样性最高的一对(任务结果相关性仅 0.39),而 Pro 与 Sol 的行为最相似(相关性 0.54)。三模型组合未能解决的仅有 4 个任务。
「模型」频道最新
- 传Anthropic内部模型不外发,闭源AI进展被指已暂停 — bindureddy · 2026-08-15
- 智谱发布GLM-5.3:743B基座,主打编码与网络安全 — max_paperclips · 2026-08-15
- DeepSeek-V4 Pro 测评:性能领先且成本极低 — zainhas · 2026-08-15
- DeepSeek-V4 Pro 编程评测:Rust 弱项但稳定性强 — zainhas · 2026-08-15
- DeepSeek-V4 Pro 击败 Sol 与 Fable — zainhas · 2026-08-15
- Qwen3.8-Max 登陆 Together AI:2.4T 总参数 — togethercompute · 2026-08-15