8小时烧光 Claude Max:Fable 5.1 编程实测数据
sprakes_ · reddit · 2026-09-02
作者在重置后的 8 小时窗口内,耗尽整个 Claude Max 配额(约 132 万输出 Token)测试 Fable 5.1 的编程能力。
核心体验:
- 模型在理解意图并转化为实现方面表现出色,优于 Fable 5。
- 能够处理复杂的遗留代码库任务,如数据流追踪、测试分类器构建和并行测试失败修复。
- 一次对话中解决了多个 P1 优先级的积压任务。
技术细节:
- 代码库设计良好,且维护了约 4 万字符的 AGENTS.md 知识库,这对 Agent 性能有显著提升。
- 总共发起了 2260 次工具调用,包含 1694 次 Shell 调用。
统计数据:
- 51 个会话,1192 轮对话。
- 约 132 万输出 Token,其中 69.8 万为推理 Token。
- 缓存读取 Token 数达 1.18 亿。
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03
- 断网手写 10 页文档后让 Agent 做成 PPT:作者发现自己文字像 AI 糊弄产物 — cnakazawa · 2026-09-03