JevBench 榜单:DeepSeek 便宜 15 倍,性价比与榜首差距悬殊
airesearch12 · x · 2026-09-24
第三方基准站 Benchmark Heaven 的 JevBench 显示,在「Jev 级模型」的公开题目上,DeepSeek V4.1 Flash(思考模式)得分达 97.8%,高于榜首 Jev 1.13.0 的 86.6%,但按每千次决策计价仅 $0.040 对 $0.594,约为前者的 1/15。该站提供成本调整、EU 主机、数据保密政策等多维过滤,作者据此认为低价同级模型具有颠覆性。
「模型」频道最新
- Fable 新行为:收到第二个提示时会中断自己先答新问题 — gleech · 2026-09-24
- Q Labs 研究:LLM 深度严重受限,128 层仍在持续改进 — rickasaurus · 2026-09-24
- 用户实测:Opus-5.5 比 Astra 快 2-3 倍、便宜 60% 且全面更优 — haydendevs · 2026-09-24
- GPT-6 Sol 只进 Codex 不进聊天,新模型重 Agent 轻对话成行业趋势 — mark_k · 2026-09-24
- Sam Altman 称赞 Anthropic 新模型,网友:我早已 Opus 上头 — haydendevs · 2026-09-24
- JevBench 新增双图表:能力与成本、速度分轴呈现不再合成单一分数 — airesearch12 · 2026-09-24