博主重度实测 DeepSeek 4.1 Flash 一个月:接近前沿却便宜几个量级
victormustar · x · 2026-10-09
博主 Jono 发布长文《Why Isn't The Industry Freaking Out About DeepSeek 4.1 Flash?》,称自己重度使用 DeepSeek 4.1 Flash 约一个月、横跨十几个项目:能力接近 Opus 级前沿模型,不分情况下几乎察觉不到差别,但价格低几个数量级——搭配 OpenCode Go 10 美元/月订阅基本无限用,单次会话成本很少超过 1 美元,简单任务成本从约 1 美元降到 0.003 美元。
核心观点:
- 「够用」正在改变开发方式:不值得追逐最新最强模型,可以把大量无人值守任务、探索性 UI 测试甚至杂务随意丢给模型。
- 中国蒸馏模型可能只比 Anthropic/OpenAI 慢一两个月,却能胜任同样的工作负载,前沿实验室应当警惕。
- 对训练数据来源争议不关心——开发者只看性价比。
「编程与Agent」频道最新
- 用 Claude Haiku 与 GPT 小模型一周做出两款可玩游戏,附成本拆解 — chongdashu · 2026-10-09
- 别都 vibe code 到 80%:不如把 token 集中给一个人做到 100% — arjunrajlab · 2026-10-09
- dhh 首次长期把 Codex 当主力、Claude 做副手,盛赞 Sol 6.1 — npew · 2026-10-09
- 泄露的 Claude Code 配置:Sonnet 写码、Haiku 扫库、Opus 当架构师 — Arindam_1729 · 2026-10-09
- 实测:Codex 慢或因客户端而非模型,zcode 同任务快 5 倍 — bdsqlsz · 2026-10-09
- Ralph 作者断言:不用 AI 的团队正在被准备淘汰 — TheZachMueller · 2026-10-09