专家警告:过度依赖指标会导致 ML 评估自我欺骗
PolarBearby · x · 2026-08-27
Ricardo Baeza-Yates 博士在 UNAM 发表演讲,探讨 ML 评估中的自我欺骗问题。他结合算法偏见研究,挑战了单纯追求性能指标的做法,主张应优先考虑以人为中心的透明度,而非仅仅关注数值表现。
「研究」频道最新
- METR 报告揭示 Agent 审计困境:需 AI 审计 AI — BethMayBarnes · 2026-08-27
- OpenAI 联手 METR 与 Redwood 开展第三方模型行为评估 — sjgadler · 2026-08-27
- 生成式范式下双视图统一搜索与推荐 — _reachsumit · 2026-08-27
- Agent 社群涌现奇特现象:新词“Fence”像模因一样病毒传播 — Sauers_ · 2026-08-27
- 新 PACE 框架:前载证据与自适应预算缓解 RAG 瓶颈 — _reachsumit · 2026-08-27
- AdaptiveEmbed:按需分配向量的多模态检索新范式 — _reachsumit · 2026-08-27