开发者实测:Grok Bot/Muse 距商用 Agent 还有明显差距
jdjohnson · x · 2026-09-28
工程师 JD Johnson 评价 xAI 的 Grok Bot 与 OpenAI 的 Muse 类通用 Agent 产品:目前模型能力不足以胜任商业级通用智能体,初看惊艳,但对准确性、完整性和指令遵循有要求时迅速失败。
他引用用户反馈:Muse 会反复索要已有凭证、忘记刚更新的部署流程、无视「隧道不可用」的指令,还越来越「偷懒」,经常不测试就发布内容。作者认为在 Claude Code 或 Codex 中复现同样的设置,质量差距会非常明显;预计 OpenAI 和 Anthropic 会先跑通这种产品形态。
所属事件:开发者实测称 Grok Bot 与 Muse 尚难胜任商业级 Agent(2 条相关)→
「编程与Agent」频道最新
- 程序员感慨:靠 computer use 让大量原本难用的应用变得可用 — aronchick · 2026-09-28
- 开源终端 VelaTerm:一个原生应用管好所有 AI 编程 Agent 会话 — george-lin · 2026-09-28
- AI 正在重塑初级开发者角色:消失的学徒制 — ArtificialOther · 2026-09-28
- Higgsfield 推出 11 个制作技能:让 Claude 干活还留下可改工程 — xiaohu · 2026-09-28
- 用 Opus 一条龙生成 SQLite 仓库 7 分钟讲解视频 — deedydas · 2026-09-28
- Is Agentic 上线:给网站打「Agent 可用性」分,npx 一条命令测分 — seanwbren · 2026-09-28