DeepSeek V4 Flash 登顶 ARC-AGI 性价比,表现媲美 Kimi K3
yacineMTB · x · 2026-08-08
据 ARC-AGI 官方验证数据,DeepSeek V4 Flash 在成本与性能的帕累托前沿上设立了新标准。该模型在 ARC-AGI-2 取得 61.4% 的成绩(单任务成本 $0.04),在 ARC-AGI-1 达到 89.0%(单任务 $0.02)。
有研究者指出,这是首次见到在同等参数规模和预训练成本下表现如此优异的模型,其实力可与 Kimi K3 比肩,并高度评价了其背后的研究团队实力。
所属事件:DeepSeek V4 Flash登顶ARC-AGI性价比前沿(3 条相关)→
「模型」频道最新
- 质疑AI推理能力:关闭推理模式后模型能力是否仍在提升? — inductionheads · 2026-08-08
- GPT-5.6 Sol 网络安全实战表现获好评,加速事件响应 — gdb · 2026-08-08
- OpenAI 与 ElevenLabs 宣布采用 Google SynthID 音频水印技术 — pushmeet · 2026-08-08
- Ollama 云端全面上线 DeepSeek-V4-Flash,输出速度超 120 tps — ollama · 2026-08-08
- DeepSeek V4 无视觉模块:模型自建亮度网格查错 — teortaxesTex · 2026-08-08
- MiniMax H3 微调遇阻:社区反映大数据集训练频繁崩溃 — Sorry_Warthog_4910 · 2026-08-08