PFN 走原生数值架构,后训练 LLM 在大表格上掉队

GaelVaroquaux · x · 2026-07-26

Gael Varoquaux 解释说,PFN 并不是把 LLM 拿来做后训练;它们使用的是原生支持数值输入的架构,不需要先把数字字符串化,然后从头训练。

他还拿 TabuLa-8B 这类工作做对比,认为这类“后训练版 LLM”只能算玩具方案:在很小的数据集上还能用,但一旦表格行数增加,很快就会掉队。

所属事件:NeurIPS 审稿争议与原生数值架构 PFN 的优势(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →