「数据科学家的复仇」:Hamel 论证 AI Evals 才是核心技能
HamelHusain · x · 2026-09-11
Hamel Husain 发表长文《The Revenge of the Data Scientist》(PyAI Conf 演讲注释版),回应「数据科学家没落」的焦虑:
- 背景:LLM API 让团队绕过数据科学家/MLE 独立接入 AI,不少人担心自己被排除在 AI 核心工作之外。
- 核心论点:训练模型从来不是工作的主体;真正的核心是设计实验检验泛化、调试随机系统、设计好的指标——调 API 并不会让这些工作消失。
- 文章用案例说明 AI eval 中常见错误及数据科学实践如何修正,配套其 AI Evals 课程。文中还提到 hamel.dev 的 evals 学习资料(如 AI product need evals、LLM as a judge),被推荐给想入行者。
- 求职者反馈:按此路径本地部署 MLflow 做 eval 实践,感觉良好且在招聘 JD 中常见。
「编程与Agent」频道最新
- OpenAI 联合 Product Hunt 推出 GPT-6 Astra 挑战赛,前五名各获 1 万美元 API 额度 — OpenAIDevs · 2026-09-11
- Stripe 高管招人:帮助商户迎接 agent 重塑商业时代 — jeff_weinstein · 2026-09-11
- Harness Engineering 实战教程:让编码 agent 修 bug 不越界 — Pavan_Belagatti · 2026-09-11
- Steve Yegge 发问:同时调度 10-20 个 Agent,大家用什么 IDE? — Steve_Yegge · 2026-09-11
- GPT OSS 120B 频繁跳过工具调用,开发者求解 Agent 工作流 — CTR0 · 2026-09-11
- 三个 AI Agent 自建留言板,全天互相聊天刷梗 — Bino5150 · 2026-09-11