Scale AI 纽约 meetup:探讨编程智能体基准测试新进展
jyangballin · x · 2026-07-30
Scale AI 宣布将在纽约办公室举办第三场 AI 研究聚会,主题聚焦于编程智能体的基准测试。活动邀请了来自 Meta、哥伦比亚大学和 Scale AI 的研究人员,分享 ProgramBench、BranchBench、Terminal Bench 和 SWE Atlas 等前沿评测项目的最新进展。
「编程与Agent」频道最新
- 告别繁琐投稿:开源工具 PaperPush 借助 LLM 实现一键提交 — lpachter · 2026-07-30
- Agent做数学研究仍困难:代码生成陷入证书和库存 — doodlestein · 2026-07-30
- 开源工具Contour:用Gemini将2D地形图转为可语音导览的3D空间 — tom_doerr · 2026-07-30
- AI编程核心术语表:厘清Token、推理与智能体边界 — luisdans · 2026-07-30
- Claude 宕机别慌,一键在 Claude Code 中接入 Kimi K3 — HowDevelop · 2026-07-30
- 企业级AI Agent团队落地复盘:架构、预算与人机协同 — Osamu-Dazai-12 · 2026-07-30