Factory AI发布Legacy-Bench,专测大模型调试迁移遗留代码的盲区
sophiamyang · x · 2026-09-25
Factory AI 宣布其基准测试 Legacy-Bench 加入 Fireworks AI 的 Specialized Intelligence Index。
- 动机:前沿大模型在遗留代码(legacy code)上存在盲区,现有基准未覆盖这块能力。
- Legacy-Bench 专门测试 AI 模型对历史系统的调试、扩展与迁移能力,面向真实软件维护场景而非刷题式编码任务。
所属事件:Factory发布Legacy-Bench专测遗留代码能力(3 条相关)→
「编程与Agent」频道最新
- 「谁有最没法合并的 AI 代码泥潭?」开发者公开征集名场面截图 — pvncher · 2026-09-25
- 开源工具 Wake:把散落本地的 Claude/Codex 会话聚合成一个可搜索窗口 — tom_doerr · 2026-09-25
- 开源轻量浏览器 curf:250KB 体积,专为 AI agent 可操控而生 — jasonkneen · 2026-09-25
- Reddit 征集 AI Agent 失控案例:无限重试、循环互甩、一夜烧光额度 — masterai01 · 2026-09-25
- Auto-Research Arena:6300 次运行中 AI 智能体独立重发现前沿 LLM 架构思路 — qixing_huang · 2026-09-25
- 2026 年用 AI 的分水岭:项目上下文数字化+用上 Agentic 工具 — Afinetheorem · 2026-09-25