scikit-learn 作者谈 Agentic 数据科学:哪些能交给 agent,如何验证
hugobowne · x · 2026-10-05
Hugo Bowne-Anderson 的播客 Vanishing Gradients 最新一期邀请 Gaël Varoquaux(scikit-learn/Inria/Probabl)、Shipra Arora(Bain)和 Luca Fiaschi(PyMC Labs)讨论 agentic 数据科学的现状:什么可以委托给 agent,以及如何验证 agent 的结果。
- 核心问题:agent 能写代码、跑分析并给出可信的解释,但如何确认它答对了问题、用对了数据、结论可执行?
- 验证在工作流内的角色分工:程序化检查、agent 互相 critique、人类判断各自承担不同职责;决策风险大小决定哪些检查可以委托。
- Varoquaux 的比喻:「agent 像咖啡,能让你更快、更有劲地干蠢事。」
- 节目还讨论 agent 常犯的错误、哪些检查本身可被委托,以及随模型进步工作流应如何演化。全程约 59 分钟。
所属事件:scikit-learn 创始人做客播客畅谈 Agentic 数据科学(2 条相关)→
「编程与Agent」频道最新
- 人机协作刷新 11 方块装箱下界至 3.875,逼近 23 年未解难题 — ctjlewis · 2026-10-05
- 引用转发的同人讨论,与上一条为同一事件,保留但以原帖为准 — ctjlewis · 2026-10-05
- Mobilerun AndroidWorld满分116/116,超谷歌Artemis — SimplyAnnisa · 2026-10-05
- Gemini Robotics-ER 2 写任务计划:双臂 FR3 协作搬运实测 — Stefania_druga · 2026-10-05
- 模型越聪明流程越多余?Dimillian 反思该回到单线程提示框了 — Dimillian · 2026-10-05
- 3D打印+ESP32+Astra,网友给孩子做了一台AI答录机 — Stefania_druga · 2026-10-05