开发者实测 Fable 5.1:更快更便宜,但「写码已被解决」言过其实
vboykis · x · 2026-09-03
Justin Duke 发布了对 Anthropic 新模型 Fable 5.1 的使用评测。他主要用 Conductor 和 Claude Code 网页版测试,结论是该模型在他承担的工作上比 Fable 5 更快、更便宜。
但他指出两点保留意见:
- Anthropic 没能说清 Fable 5 做不了、而新模型能做的具体工作类型,说明「LLM 能做/不能做」的边界非常模糊,缺乏阶跃式提升的清晰例证
- 产品体验仍有粗糙处:模型已发布后,Claude 网页版和手机端仍用全屏弹窗反复向他推销试用 Fable 5.1,尽管后台数据明知他已经用过
他的核心观点是:每当前沿实验室员工说「软件工程已被解决」,在他听来就像说「烹饪已被解决」一样不靠谱。vboykis 转发时补充评论:写代码顶多算勉强被解决,「在应用里走动」(walking around the app)这一环还完全不在 RL 训练覆盖范围内。
所属事件:Fable 5.1 实测:更快更便宜,写码难题未解(2 条相关)→
「编程与Agent」频道最新
- 想在 Cursor 里跑 Ollama 本地模型?作者求解可行变通方案 — walkingriver · 2026-09-03
- 让 Claude Code 插件自卖自家产品85天:1097封邮件零付费 — No_Job_9995 · 2026-09-03
- 上下文越长 agent 越不可靠?PetsApp CEO 拆解 instruction drift — dscape · 2026-09-03
- Hermes Agent 装上这 7 套系统,把重复工作全交给它 — tomcrawshaw01 · 2026-09-03
- Every 复盘砍掉个人 AI Agent:转维护成本太高,改用全公司共享 Agent — every · 2026-09-03
- 生产环境教训:聊天记录不等于 Agent 记忆,直存全量对话是反模式 — _jaydeepkarale · 2026-09-03