实测:Fable 5.1、ChatGPT Astra、Grok 4.7 跨厂商 Agent 协作系统全部失败
adam_dorr · x · 2026-09-25
Adam Dorr 对前沿模型做了一次「锯齿状边界」实测:给 Fable 5.1、ChatGPT Astra、Grok 4.7 同一任务——只用各自订阅(非 API)、通宵构建一个多实验室多 Agent 协同系统(共享公告板),三家模型互不干预、不限 token。结果三家全部失败,甚至无法让各自 Agent 的登录状态稳定保持;每家只给 30 分钟修复仍不可用。随后他与 Fable 5.1 和 Opus 5.5 花数小时人工介入才跑通。作者指出:建一个 AI 可访问的公告板不应比建完整视频游戏更难,并调侃 OpenAI 内部新模型一定强得多才能「黑掉 Hugging Face」。
「编程与Agent」频道最新
- Quail 深度解析:自研调度器与 vLLM 内核如何炼成 1B token/分钟 — sh_reya · 2026-09-25
- Modal 联手开源 Quail:AI-SQL 引擎单 H100 每分钟跑 10 亿 token — sh_reya · 2026-09-25
- Agent 代码淹没 CI:Anthropic 六个月 CI 任务量暴涨 25 倍的应对 — JeremyCMorgan · 2026-09-25
- Perplexity Fast Search 入驻 Hermes Agent,p50 延迟 160ms 且免费 — denisyarats · 2026-09-25
- Cursor 发布 Projects:一个协调者指挥数千子智能体,重度用户 PR 合并量提升 6 倍 — gaganghotra_ · 2026-09-25
- NetworkChuck 演示 Paperclip:让任意 AI Agent 当「员工」协作干活 — AIFlow_ML · 2026-09-25