Docusign×NVIDIA:900M 参数专用模型抽合同表格,快 20 倍
AI Engineer · youtube · 2026-09-16
AI Engineer 频道访谈 Docusign 的 Hiral Shah 与 NVIDIA 的 Sean Sodha,讲合同数据如何成为工程难题。
- 规模:约 2 万亿美元谈好的合同价值锁在无人回看的 PDF 里;Docusign 有近 200 万付费客户、10 亿用户,每天约 100 万份协议流转
- 痛点在表格:定价阶梯、费率、SKU、SLA 恰是用户最需要的信息,也是通用抽取最弱的一环——逐行读取会破坏合并单元格与嵌套列
- 方案:双方共同构建了仅约 900M 参数的视觉语言模型,定位是抽取器而非生成器,一次推理同时返回阅读顺序、语义结构与保留完好的表格,替代原先一堆布局/表格专用模型
- 核心教训是克制:专用小模型跑表格抽取比测试过的通用方案快约 20 倍,低上下文带来低延迟与低成本
- 结尾 Q&A 探讨 OCR 是否会被淘汰
「研究」频道最新
- 多智能体强化学习入门教材出新版,系统讲解 CTE/CTDE/DTE 三大范式 — dhadfieldmenell · 2026-09-17
- 随机对照试验:LLM 未能显著提升新手端到端湿实验能力 — anshulkundaje · 2026-09-17
- Noah Giansiracusa 发文陶哲轩博客:别让食客进厨房,数学何以为继 — AlexKontorovich · 2026-09-17
- 新论文:上下文学习在语言、基因组、蛋白质等六种模态中普遍涌现 — DanielKhashabi · 2026-09-17
- 去年底 AI 研究者预测:千禧年数学难题 2054 年前无解,现实已提前 — Tolopono · 2026-09-17
- UChicago 研究员招 AI×经济学 predoc,可共一作发论文 — ethayarajh · 2026-09-17