Latent Space 访谈:TypeSafe CEO 为何反对给模型 Jev 公开跑分
Latent Space · youtube · 2026-09-29
Latent Space 频道发布对 TypeSafe CEO 的访谈,主题是他为什么不相信对自家模型 Jev 进行公开基准测试。核心观点是公开榜单会诱导针对评测的优化,而非真实用户价值,厂商更应依赖内部评估与真实工作负载验证。这是当前'榜单驱动开发'争议的代表性厂商立场。
「公司和人」频道最新
- 沃尔玛承诺不用 AI 差别定价,有人呼吁对 AI 收入征 45% 重税 — lipeng0820 · 2026-09-29
- 「我们不知道在做什么,请叫停我们」:Domingos 调侃史上最怪 IPO 话术 — pmddomingos · 2026-09-29
- Timnit Gebru 批媒体帮厂商包装失控模型为「流氓模型」 — AlexTensor · 2026-09-29
- 飞抵 SFO 满眼 CoreWeave 广告,还撞见 OpenAI Codex 广告里的熟人 — altryne · 2026-09-29
- beffjezos 判言 AI 进入「物种分化」:不再只拼规模,开始各拼各的 — beffjezos · 2026-09-29
- 柏林 13 支团队现场路演,下一代欧洲 AI 与机器人公司在冒头 — MarioKrenn6240 · 2026-09-29