本地 Qwen3.8-Flash-Next 对战 Claude Opus 5.5 同题实测:更慢但测试更全
deepu105 · reddit · 2026-10-06
作者在 Strix Halo 笔记本(ASUS ROG Flow Z13,128GB 内存)上用本地运行的 Qwen3.8-Flash-Next(xhigh 档,Pi harness)与云端 Claude Opus 5.5(Claude Code,medium 档)完成同一复杂 Rust 项目功能,做了完整对比。
结果对比(为 LlamaStash 添加 daemon restart 命令)
- 耗时:Opus 约 18 分钟 vs 本地模型约 130 分钟
- Tokens:Opus 7.83M in / 41.5K out vs 本地 20.61M in / 101K out
- 成本:Opus $7.53 vs 本地 $0(约 0.15 kWh 电费)
- 质量:让 GPT 5.6、Opus 5.5 与 Flash-Next 交叉评审,Flash-Next 的 PR(#89)胜出,测试更好(4 个测试含 2 个端到端)、边界处理更完善,作者最终合并 #89 并移植 #88 的修复
其他细节
- Flash-Next 当时跑在旧版 Halogen 引擎上(中途掉线一次换到 Gufo);当前 Halogen 在 70W 下可达约 1400 t/s prefill、46 t/s decode,重测耗时会大幅下降
- 结论:Opus 仍快 2-10 倍,作者继续用它做规划和评审,但实际编码已转移到本地模型,本地模型已能正面对抗前沿模型
所属事件:本地 Qwen3.8-Flash-Next 实测对决 Claude Opus 5.5(2 条相关)→
「编程与Agent」频道最新
- Rippling 用 Deep Agents 与 LangSmith 6 个月上线全产品 AI — LangChain · 2026-10-06
- 微软团队分享微调模型胜任 Excel 等知识工作的演讲 — marlene_zw · 2026-10-06
- 生产环境里怎么改 Agent 权限?Reddit 工程师征集实践方案 — BaraSlim · 2026-10-06
- Armin Ronacher 详解 Codemode:Pi 1.0 为何用代码而非 MCP 工具 — mitsuhiko · 2026-10-06
- T3 Code 上线应用内可视化,Agent 可在会话中构建动态体验 — 0xkarasy · 2026-10-06
- 用 Codex 写连线通信,做出双人对战 Game Boy 涂弹游戏 — pvncher · 2026-10-06