Thinkymachines 扩招评估团队,聚焦模型效用
ziqiao_ma · x · 2026-08-31
Thinkymachines 正在扩大其评估团队。团队关注模型是否真正有用,以及测量方法是否足以作为缩放研究的 Y 轴。工作范围涵盖构建用于预测缩放的内部评估、将用户反馈和工作流转化为可用的评估、审核评分器和测试线,以及开发可定制化的新基准。
「公司和人」频道最新
- 个人网站 8 月数据:AI 助手流量占比仅 0.19% — gaganghotra_ · 2026-08-31
- 质疑 OpenAI 与 Anthropic 永久性隐瞒模型真实能力 — scaling01 · 2026-08-31
- Sapient 观察:自主研发成跨行业通用需求 — JaynitMakwana · 2026-08-31
- AI 创业者痛点:从客户反馈到产品功能的转化难题 — Srinidhi_Murali · 2026-08-31
- 创业点子:打造深度挖掘与推送的 Google Alerts 2.0 — garrytan · 2026-08-31
- 旧金山未死:OpenAI 与 Anthropic 成新支柱 — garrytan · 2026-08-31