DeepSeek 4.1 Flash 实测:缓存命中降价 7 倍,编码与 3D 场景生成大跃进
卡尔的AI沃茨 · wechat · 2026-09-11
作者实测 DeepSeek 新发布的 4.1 Flash:9 月 14 日中午起所有发往 v4-pro 的请求将被强制路由到 4.1 Flash 并按其低价计费。架构为 552B MoE(激活 8B),含 196B Engram 记忆参数,1M 上下文、最大输出 384K,并首次原生支持视觉;KV cache 压到每 token 约 890 字节,仅为上一代四分之一,缓存命中输入价格降 7 倍以上。软件工程基准 DeepSWE v1.1 超过 gpt5.6Sol 与 claudeOpus5,但复杂科学与图像分析仍逊于闭源顶配。
实测用 DeepSeekHarness 新桌面版跑多组一句话生成任务:手写 WebGL 的停车小车、Crossy Road(稳定性不如 GLM 5.3 Flash)、3D 像素山谷与日系动漫风街区(视觉大幅进步、胜过 GLM),还复刻了 Reddit 上爆火的「Three.js 版城市:天际线」项目,2 小时跑出带实时微观经济系统的可交互城市沙盘。作者也吐槽桌面版手机连接功能形同虚设、偶发扩展报错,并总结:便宜只是入场券,稳定性和省下的注意力比 token 更值钱。
「模型」频道最新
- CritPt 评测被指严重损坏,蚂蚁已在 F5.1 系统卡中用修复版替代 — xeophon · 2026-09-11
- Polymarket 开盘押注 OpenAI GPT-6 Astra 会否被停止公开访问 — Polymarket · 2026-09-11
- 用户实测:GPT-6 Astra 画 SVG 图标表现相当不错 — floguo · 2026-09-11
- 谷歌 AI 搜索「内心戏」外泄:自我纠结毒理会否采信的草稿被晒出 — real_maximpulse · 2026-09-11
- 机器学习学者感叹:早该换 200 美元/月的 Codex 套餐 — burkov · 2026-09-11
- 一句话测出模型是否降智:让 AI 用 SVG 画骑车的鹈鹕 — lxfater · 2026-09-11