PFN 走原生数值架构,后训练 LLM 在大表格上掉队
GaelVaroquaux · x · 2026-07-26
Gael Varoquaux 解释说,PFN 并不是把 LLM 拿来做后训练;它们使用的是原生支持数值输入的架构,不需要先把数字字符串化,然后从头训练。
他还拿 TabuLa-8B 这类工作做对比,认为这类“后训练版 LLM”只能算玩具方案:在很小的数据集上还能用,但一旦表格行数增加,很快就会掉队。
所属事件:NeurIPS 审稿争议与原生数值架构 PFN 的优势(2 条相关)→
「研究」频道最新
- 一本新书聚焦知识图谱与 LLM 的连接式 AI 系统 — blaizedsouza · 2026-07-26
- 论文称 GPU collective 延迟里每微秒都很关键 — TheZachMueller · 2026-07-26
- DAIR-AI 提示工程指南汇总了 RAG 和 Agent 资料 — blaizedsouza · 2026-07-26
- Graph RAG 用图遍历替代 top-k 检索,号称省 32 倍内存 — blaizedsouza · 2026-07-26
- 仿象鼻机械臂用内置摄像头实现触觉感知 — rvp · 2026-07-26
- 逆向 SolidWorks 文件发现操作历史,可训练 CAD 模型 — yacineMTB · 2026-07-26