DeepSeek-V4 Flash 软件工程实测:性能达 GPT-5.6 八成
zainhas · x · 2026-08-07
Together Compute 基于 DeepSWE 基准对 DeepSeek-V4 Flash-0731 和 GPT-5.6 Luna 在软件工程任务上进行了对比分析。
数据显示,DeepSeek-V4 Flash-0731 能够提供 GPT-5.6 Luna 约 80% 的性能表现,但单任务成本仅为后者的六分之一。这表明 DeepSeek 的新模型在性价比上具有显著优势。
所属事件:DeepSeek-V4 Flash vs GPT-5.6 Luna:性价比完胜,质量达八成(11 条相关)→
「模型」频道最新
- 实测 2bit 量化模型:显存占用减半,速度翻倍且性能未损 — WigglyScrotum · 2026-08-07
- DeepSeek 流量激增,缓存命中率表现优异 — teortaxesTex · 2026-08-07
- Meta 模型斩获五项 STEM 奥林匹克竞赛金牌 — ilkamoi · 2026-08-07
- 曝 Ilya 创办 SSI 已开始评测其首款新模型 — zephyr_z9 · 2026-08-07
- OpenAI 模型后训练再遭质疑,被指品味不足 — willdepue · 2026-08-07
- 闭源前沿模型陷入安全暂停,开源阵营宣称迎头赶上 — bindureddy · 2026-08-07