表格学习评估要跨数百张表做交叉验证
GaelVaroquaux · x · 2026-07-26
Gael Varoquaux 指出,表格学习(tabular learning)的评估长期做得不够严谨:真正靠谱的评估需要在数百张表上做交叉验证,而每张表往往有数千到几十万行数据。
他认为,过去评估不足是这个方向停滞的重要原因之一。线程里的玩笑式回复也点出了另一个现实:审稿人当然会希望模型越大越好,但核心不是“模型有多大”,而是评估是否真的足够严格。
所属事件:学者探讨 PFN 与后训练 LLM 处理表格差异(4 条相关)→
「研究」频道最新
- Orca 开源灵巧手研究栈,打通遥操作与训练 — tensorqt · 2026-07-26
- 本周 AI 论文盘点:世界模型、具身智能体与自改进 agent — _akhaliq · 2026-07-26
- PFNs 从头训练做表格数据,后训练 LLM 很快撞墙 — roydanroy · 2026-07-26
- 论文发现 RL 收益可由预训练损失预测,最优算力占比约 20% 至 28% — rohanpaul_ai · 2026-07-26
- 2007 年集合通信综述,至今仍适合入门 NCCL — abhi9u · 2026-07-26
- 阿里和港中文用一张图预测机器人场景的 4D 未来 — jiqizhixin · 2026-07-26