Baeza-Yates 演讲:机器学习模型评估何时能不再自欺
PolarBearby · x · 2026-10-09
Ricardo Baeza-Yates(KTH 皇家理工学院与庞培法布拉大学)在西班牙 UCLM 的演讲《机器学习模型评估:我们还要自欺到何时?》已放出完整视频,附章节索引。
演讲主线:
- 数据问题与「逼近现实」的局限,自动驾驶等非人为错误案例
- 自动化系统的社会影响:澳大利亚 Robodebt 与荷兰福利欺诈系统案例
- 评估的核心缺陷:用平均值掩盖多样性、医疗黑箱谬误与「绝地悖论」
- 模型复杂度度量(如数人脸示例)、AI 是工程还是炼金术
- 图像分类与癌症检测中的关键错误、预测性伪科学与评估偏差
- Goodhart 定律与预测优化的陷阱
「漫话AGI」频道最新
- 「3D 打机曾宣称人人自印商品」:对 AI 颠覆论的历史类比 — kylegawley · 2026-10-09
- 该不该给 AI 功能加个「能耗标签」,像汽车油耗一样? — yi111 · 2026-10-09
- Instagram 16 周年引感慨:造原子弹带来和平,做修图应用毁了世界 — CatAstro_Piyush · 2026-10-09
- Garrison Lovely:AI 安全工会或是比辞职更有效的内部制衡 — GarrisonLovely · 2026-10-09
- Grady Booch 谈意识判定:意识是光谱,如色情「看到就知道」 — Grady_Booch · 2026-10-09
- Grady Booch:虐待 AI 暴露的是你,而非机器有意识 — Grady_Booch · 2026-10-09