DeepSeek V4 Flash 登顶 ARC-AGI 性价比前沿,成本仅 GPT-5.6 四分之一
GregKamradt · x · 2026-08-08
DeepSeek V4 Flash 在 ARC-AGI 基准测试中取得了惊艳表现,重新定义了成本与性能的帕累托前沿。
据 ARC Prize 官方验证,该模型在 ARC-AGI-2 取得 61.4% 的成绩(单任务成本 0.04 美元),在 ARC-AGI-1 取得 89.0% 的成绩(单任务成本 0.02 美元)。网友指出,这相当于以 GPT-5.6 Luna (Max) 四分之一的成本,获得了同等量级的性能表现。
所属事件:DeepSeek V4 Flash登顶ARC-AGI性价比前沿(2 条相关)→
「模型」频道最新
- Qwen3.8-Max实测领先Gemini 3.5 Flash 8.5个百分点 — usamawahabkhan · 2026-08-08
- Semianalysis深度分析Gemini 3.5 Pro:性能与架构解读 — Charuru · 2026-08-08
- DeepSeek V4 Flash 登上 ARC Prize 评测榜单 — tosh · 2026-08-08
- Pokee AI 推出 1000 万 token 上下文模型 Isaac 及其 API — Kyrannio · 2026-08-08
- 观点:谷歌Meta若想翻盘,直接发个比K3更强的开源模型 — bindureddy · 2026-08-08
- 为什么大模型数不准字数?需中间 token 辅助 — ctjlewis · 2026-08-08