PM 自建评测 scorer 工作流仍无解,CoreWeave 据称正在着手
_ScottCondron · x · 2026-10-08
作者指出,行业做了几年仍没人解决「PM 构建 scorer(自动评分器)」的工作流:标注噪声大、定义「什么是好」很难、PM 又忙。他对 CoreWeave 在这块酝酿的东西表示期待,并招募拥有可用 agent 的团队,帮忙在开源模型上把 agent 做得更好更便宜。
「编程与Agent」频道最新
- GraphRAG 增量更新漏洞:删除的文档仍留在索引中可被检索 — JeremyCMorgan · 2026-10-08
- 论文:Vibe Coding 正在杀死开源,被推荐组件 Star 反跌 — soumitrashukla9 · 2026-10-08
- Every 发布 Compound Engineering 权威指南:让代码库越写越容易 — every · 2026-10-08
- Claude Haiku 5.5 发布:与 GPT-6 Luna 同价,但暗藏 token 膨胀 — Simon Willison · 2026-10-08
- 实测 Haiku 5.5 替代 Opus 跑浏览器测试:漏一项但性价比突出 — kevinkern · 2026-10-08
- Agent 测试游戏时在会议中自动启动,音乐响了 15 秒 — Aizkmusic · 2026-10-08