DeepSeek V4 Flash 登顶 ARC-AGI 性价比前沿,成本仅 GPT-5.6 四分之一

GregKamradt · x · 2026-08-08

DeepSeek V4 Flash 在 ARC-AGI 基准测试中取得了惊艳表现,重新定义了成本与性能的帕累托前沿。

据 ARC Prize 官方验证,该模型在 ARC-AGI-2 取得 61.4% 的成绩(单任务成本 0.04 美元),在 ARC-AGI-1 取得 89.0% 的成绩(单任务成本 0.02 美元)。网友指出,这相当于以 GPT-5.6 Luna (Max) 四分之一的成本,获得了同等量级的性能表现。

所属事件:DeepSeek V4 Flash登顶ARC-AGI性价比前沿(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →