DeepSeek V4 Flash 靠自我验证 scaling 胜 Claude Fable 5,成本仅 1/11
KingDDev · x · 2026-08-19
引用的原帖称:用「自我验证 scaling」(scaling self-verification)的 DeepSeek V4 Flash 在 Terminal-Bench 2.1 上击败了 Claude Fable 5,且成本低 11 倍。发帖人开玩笑接梗:那要是跑 5 个 Fable 5 加第 6 个当裁判呢?
所属事件:DeepSeek V4 Flash 自验证 scaling 以 1/11 成本胜 Claude Fable 5(5 条相关)→
「模型」频道最新
- Claude 隐形水印发布数小时即被破解,绕过代码获两万收藏 — deliprao · 2026-08-24
- Sonnet 4.5 与 Opus 3 对话时出现密集怪异行为 — repligate · 2026-08-24
- 有人整理了一份全面的 AI 模型排行榜 — FinanceYF5 · 2026-08-24
- 用户实测 LTX 模型乐器生成能力优于 H3 — cocktailpeanut · 2026-08-24
- 15款主流AI模型排梯队:Fable 5 S+,Kimi K3 B档 — FinanceYF5 · 2026-08-24
- 视频生成占中国 AI 算力 70%,中美发展路径迥异 — AccBalanced · 2026-08-24