Together 实测:GLM-5.3 四次尝试在 DeepSWE 上胜 Fable 5 且更省
togethercompute · x · 2026-08-23
Together Compute 发帖称,在 DeepSWE 基准上,GLM-5.3 以最多四次尝试达到 87.6% 的解决率,总成本约 16 美元;而 Fable 5 解决率为 69.7%,成本 21.63 美元——GLM-5.3 在解决率与总成本上双双占优。
「编程与Agent」频道最新
- 开源项目 Pentest-Swarm:AI 群体自主执行渗透测试 — tom_doerr · 2026-08-23
- 单 Agent 多技能 vs 多 Bot,本质并无区别 — evielync · 2026-08-23
- Nowledge-mem:支持上下文记忆的 Vibe Coding 工具 — vista8 · 2026-08-23
- 高危工具需双重确认:agent 权限治理速查表 — blaizedsouza · 2026-08-23
- AgentOne:开源跨平台 MCP 客户端,支持自定义与扩展 — best_codes · 2026-08-23
- 双 3090 跑通 Qwen 27B 全量上下文:3200 tok/min 实战配置 — CryptographerLow7817 · 2026-08-23