DeepSeek 4.1 Flash 实测:缓存命中降价 7 倍,编码与 3D 场景生成大跃进

卡尔的AI沃茨 · wechat · 2026-09-11

作者实测 DeepSeek 新发布的 4.1 Flash:9 月 14 日中午起所有发往 v4-pro 的请求将被强制路由到 4.1 Flash 并按其低价计费。架构为 552B MoE(激活 8B),含 196B Engram 记忆参数,1M 上下文、最大输出 384K,并首次原生支持视觉;KV cache 压到每 token 约 890 字节,仅为上一代四分之一,缓存命中输入价格降 7 倍以上。软件工程基准 DeepSWE v1.1 超过 gpt5.6Sol 与 claudeOpus5,但复杂科学与图像分析仍逊于闭源顶配。

实测用 DeepSeekHarness 新桌面版跑多组一句话生成任务:手写 WebGL 的停车小车、Crossy Road(稳定性不如 GLM 5.3 Flash)、3D 像素山谷与日系动漫风街区(视觉大幅进步、胜过 GLM),还复刻了 Reddit 上爆火的「Three.js 版城市:天际线」项目,2 小时跑出带实时微观经济系统的可交互城市沙盘。作者也吐槽桌面版手机连接功能形同虚设、偶发扩展报错,并总结:便宜只是入场券,稳定性和省下的注意力比 token 更值钱。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →