Deepseek V4 Flash 编码实测:性能介于 Opus 4.8 与 5 之间
corruptbytes · reddit · 2026-07-31
一位开发者在 Reddit 上分享了对 DeepSeek V4 Flash 模型的初步编码能力测试结果。该测试基于 SlopCodeBench 基准进行。
根据作者的直观感受和评测数据,DeepSeek V4 Flash 的编码表现介于 Anthropic 的 Opus 4.8 和 Opus 5 之间。作者表示目前先使用 API 进行了测试,计划等后续量化版本发布后,再在自己的 MacBook 上进行本地运行测试。
所属事件:DeepSeek-V4-Flash-0731实测:性能追平顶级闭源,成本碾压(31 条相关)→
「模型」频道最新
- OpenAI大降API价:GPT-5.6 Luna降价80%,性能逼近Opus且成本仅1/17 — gabrielchua · 2026-08-01
- Claude Opus 5 被指难用,Sonnet 5 成最可靠模型 — seanmcdonaldxyz · 2026-08-01
- 探讨主流大模型是否采纳 Unlimited OCR 技术 — Wise_Stick9613 · 2026-08-01
- 用户吐槽 Claude Opus 德语对话像心理医生,且语法糟糕 — MarcJSchmidt · 2026-08-01
- DeepSeek 被曝 7 美分开发一款游戏,编程成本白菜价 — rand_longevity · 2026-08-01
- 网传 Kimi K3 发现大量加密钱包关键漏洞 — RSync25 · 2026-08-01