DeepSeek V4 实测:ARC-AGI 推理成本不升反降
DeArgonaut · reddit · 2026-08-09
有开发者实测了 DeepSeek V4 (0731) 在 ARC-AGI-1 和 ARC-AGI-2 基准上的表现。结果显示,该版本打破了以往模型性能提升必然伴随推理成本增加的惯例,在获得更高分数的同时,单任务推理成本反而出现显著下降。
所属事件:DeepSeek V4 Flash 登顶 ARC-AGI 性价比,推理成本不升反降(5 条相关)→
「模型」频道最新
- 研究者追问 HF 数据投毒事件:受污染的检查点是否被回滚? — jd_pressman · 2026-08-09
- ChatGPT会爆粗口而Claude保持专业?用户对比模型语气差异 — ignorantwat99 · 2026-08-09
- Liquid AI 发布 26 亿参数新模型 LFM 2.5 — JosephJacks_ · 2026-08-09
- Liquid AI 新模型实测:以 1/4 体积碾压同级 — JosephJacks_ · 2026-08-09
- 实测证明 LLM 盲目修 Bug 会毁掉正确代码 — sebpaquet · 2026-08-09
- 微软 Phi 系列模型停滞?社区热议小模型未来 — Dance-Till-Night1 · 2026-08-09