GLM 5.2 被曝能驾驭多节点 H100 集群,成最强开源自动科研模型
_ScottCondron · x · 2026-07-23
推文讨论了 GLM 5.2 在自动化科研任务中的表现,称其正在成为首个能处理实质性科研任务的开放权重模型。
- 核心能力:能够自主调试环境配置问题,并在多节点 H100 集群上运行和对比强化学习(RL)训练实验。
- 当前局限:缺乏图像理解能力,无法像 Claude 3 Opus 或 Fable 那样直接“看懂”图表,只能通过编程方式解析原始 WandB 数据。
- 生态进展:Weights & Biases (W&B) 正在推进其智能体 ARIA 的功能,使其能更好地理解和控制工作区中的图表,以提升智能体分析实验结果的体验。
「编程与Agent」频道最新
- 实测 Gemini 3.5 Flash-Lite:文档提取比 Claude 便宜 71 倍 — rseroter · 2026-07-23
- Cohere将办演讲:探讨LLM智能体可靠性与不确定性信号 — Cohere_Labs · 2026-07-23
- LangChain 和 Cognition 将办 agent 开放记忆活动 — LangChain · 2026-07-23
- Factory 联创预测:未来两年内 90% 的编程 Agent 将实现完全自主 — matanSF · 2026-07-23
- 语音助手把后端迁到欧洲后,工具调用立刻变快 — ur_piyo_a_hoe · 2026-07-23
- W&B 的 Scott Condron 想重回开发者关系:押注研究代理与评测界面 — _ScottCondron · 2026-07-23