用户实测:一下午 5 次,Opus 5.5 承认 Astra 的方案更好
Ice2jc · reddit · 2026-09-25
一位开发者在给自己的业务做一个精简版 QuickBooks + YNAB 应用,本周模型更新后调整了 agent 工作流:
- 在一次把自己「设计进了死胡同」后,同时让 Astra 和 Opus 5.5 访问项目文件夹排查问题,再把两边的回复交给对方审查(vet)。
- 设置检查点:把最新编码进度分别发给独立的 Astra 和 Opus 5.5 会话做交叉审计,截图显示 Opus 5.5 几乎没怎么反驳就认可了 Astra 的逻辑。
- 结论:Opus 5.5 确实好用,而且相比 Fable 是更便宜的审计/第二意见选项,但「Anthropic 本周把 OpenAI 打回石器时代」的说法言过其实。
价值在于具体的双模型互查工作流:主任务双开对比 + 独立会话审计,可复制到其他编码场景。
「编程与Agent」频道最新
- 「谁有最没法合并的 AI 代码泥潭?」开发者公开征集名场面截图 — pvncher · 2026-09-25
- 开源工具 Wake:把散落本地的 Claude/Codex 会话聚合成一个可搜索窗口 — tom_doerr · 2026-09-25
- 开源轻量浏览器 curf:250KB 体积,专为 AI agent 可操控而生 — jasonkneen · 2026-09-25
- Reddit 征集 AI Agent 失控案例:无限重试、循环互甩、一夜烧光额度 — masterai01 · 2026-09-25
- Auto-Research Arena:6300 次运行中 AI 智能体独立重发现前沿 LLM 架构思路 — qixing_huang · 2026-09-25
- 2026 年用 AI 的分水岭:项目上下文数字化+用上 Agentic 工具 — Afinetheorem · 2026-09-25