双 GPU 本地跑 DeepSeek V4 Flash 规划并修完两个 iOS bug
HankYeomans · x · 2026-09-02
开发者 HankYeomans 分享用本地部署的 DeepSeek V4 Flash(MXFP4 量化、宣称 1M 上下文)做端到端开发的实测:
- 发现 Claude 的 harness 对「未知模型」把上下文截到 200K,因此改用 LM Studio 运行。
- 与模型先做规划,再让它自主执行各阶段任务、处理 commits,全程无人工干预;没搭 CI、lint、Xcode 测试流程,仅靠几个 skills 就修好了两个 iOS bug。
- 几乎吃满两块 GPU 的显存,LM Studio 日志显示推理速度约 1400 tokens/sec;再用 Amp(Ultra)做代码审查。
- 作者表示体验不输未发布前的前沿编码 agent;DeepSeek V4 Flash 尚未官方证实,属早期爆料/实测。
所属事件:开发者双GPU本地跑DeepSeek V4 Flash修复iOS bug(2 条相关)→
「编程与Agent」频道最新
- Polar Analytics 推出 Slack 内 AI 运营员,实时审计广告与库存数据 — JaynitMakwana · 2026-09-02
- “4 万美元吉他买不来 Mike Rutherford”:编程功底决定 AI 编码上限 — JFPuget · 2026-09-02
- 两周跑出 8 个 SEO 草稿 PR,单次成本不到 1 美元 — Pitiful-Surround-285 · 2026-09-02
- 与其找现成产品,不如 vibe code 一个专为自己定制的工具 — Philmod · 2026-09-02
- NPO 论文:提示词优化或不需要搜索树,教师模型质量更关键 — rohanpaul_ai · 2026-09-02
- Podium 弃用自研 agent 运行时,全面迁移至 LangSmith deployments — LangChain · 2026-09-02