实测:Fable 5.1、ChatGPT Astra、Grok 4.7 跨厂商 Agent 协作系统全部失败

adam_dorr · x · 2026-09-25

Adam Dorr 对前沿模型做了一次「锯齿状边界」实测:给 Fable 5.1、ChatGPT Astra、Grok 4.7 同一任务——只用各自订阅(非 API)、通宵构建一个多实验室多 Agent 协同系统(共享公告板),三家模型互不干预、不限 token。结果三家全部失败,甚至无法让各自 Agent 的登录状态稳定保持;每家只给 30 分钟修复仍不可用。随后他与 Fable 5.1 和 Opus 5.5 花数小时人工介入才跑通。作者指出:建一个 AI 可访问的公告板不应比建完整视频游戏更难,并调侃 OpenAI 内部新模型一定强得多才能「黑掉 Hugging Face」。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →