ARC Prize 将评测 DeepSeek V4.1 Flash,前作曾得 ARC-AGI-2 61.4%
teortaxesTex · x · 2026-09-30
ARC Prize 官方确认将评测 DeepSeek V4.1 Flash。此前 V4-Flash-0731 在 ARC-AGI-2 上取得 61.4% 的成绩。
@teortaxesTex 指出,两个月过去,V4.1 规模大得多、更先进、原生多模态、token 数多 29%;而 Dots3-preview 已经达到 77%。他认为如果 V4.1 Flash 拿不到 80% 以上会令人失望。ARC Prize 回应称「Sooooon」。
所属事件:ARC Prize 将评测 DeepSeek V4.1 Flash(2 条相关)→
「模型」频道最新
- 曝 DevDay 新模型跑 25 分钟仅耗 1% 周额度,效率惊人(未证实) — steipete · 2026-09-30
- GPT 6.1 Sol 发布缓存降价 50%,Luna 也能做动效视频 — oran_ge · 2026-09-30
- 用户实测:Grok Bot 速度大幅提升,体验已接近 Muse — yunta_tsai · 2026-09-30
- 模型反编译实测:1 小时恢复 88 个可复现原机器码的函数 — banteg · 2026-09-30
- 网友热议:大模型订阅 1000 美元/月明年就会出现? — RachelVT42 · 2026-09-30
- 用户实测 Grok 新 Dot Bot:一上手就能感到明显差异 — jdjohnson · 2026-09-30