实测 MiMo 2.6 走 pelican 测试:plan 模式把调用数砍到 12-17 次
PilgrimofHaqq2 · reddit · 2026-09-28
作者用 pelican SVG 测试对比 MiMo 2.6(Flash/Pro)开启与关闭 plan 模式的 agent 行为差异:
- Plan 模式:先通过一轮问答确定风格/场景/尺寸,然后一次性写出完整 SVG(Flash 11.1KB、Pro 22.1KB),并把所有渲染修复合并为一次编辑,总调用数仅 12 和 17 次。
- 无 plan 模式:迭代更多。Flash 做了 3 轮渲染修复,约 10 次调用浪费在图像验证上(裁剪读取不匹配、缩放视图、过期预览渲染);Pro 2 轮修复外加 4 次工具失误,其中一次生成了 3743 tokens 后因缺少参数被拒而全部丢弃。
- 有趣发现:Flash plan 模式生成的 token 反而更多(27.2k vs 20.4k)——「更少但更大的调用」并不意味着更少的工作量。
结论:plan 模式的价值在于把碎片化迭代收敛为少量大调用,而非降低总 token 消耗。
「编程与Agent」频道最新
- Jev 适合做机器人高层编排?快速 schema 输出或胜 LLM 延迟 — ai · 2026-09-28
- Apple 端侧模型 fm 搭决策小模型 Jev,路由测试全对比 — jasonkneen · 2026-09-28
- Codex 建应用很能干,连 Chrome 现有会话却频繁掉链子 — ChrisGPT · 2026-09-28
- DeepSeek 发布 Codex 式 Agent 框架,可接入多家模型供应商 — ChrisUniverse · 2026-09-28
- 用 Claude Code 打造菜单栏 Agent 应用 CoIsland,35+ 连接器监控开发工具 — DonTizi · 2026-09-28
- Andrew Carr 称用 Astra 跑出哈希一致的可复现输出 — andrew_n_carr · 2026-09-28