TypeSafe 两级抽取级联:小模型初抽+验证器把关,成本仅推理模型零头
TheMoonMidas · x · 2026-09-22
TypeSafe AI 公开其 SDE cascade(结构化数据抽取级联)方案:用便宜的小模型先抽取,再用逐字段是非题验证器检查,验证信号触发时才升级到大推理模型,从而以极低成本拿到接近大模型的质量。
- 模型与定价(2026 年 9 月标准价,输入/输出每百万 token):rung 0 用 gpt-5.4-mini($0.75/$4.50);rung 1 用 gpt-5.5($5.00/$30,约为 mini 的 7 倍);验证器用 TypeSafe 自家 jev-1.12($0.042/输出免费)。
- 工作流程:小模型抽取 → 验证器对每个字段返回「是否有问题」的概率 → 信号触发才升级到推理模型,否则保留便宜答案。
- 细节取舍:两级抽取都用纯文本模式,不用结构化输出/tool calls/ mode——作者认为 schema 跟随错误不是 LLM 常见的失败模式,约束解码也修不了根因。
- 附带一个端到端实例和跨 100 个 prompt 的成本-质量权衡分析。
「编程与Agent」频道最新
- Deel 推出企业运营 Agent 平台 Akai,演示一次即可自动化工作流 — kimmonismus · 2026-09-22
- Uncle Bob 演示 uml-viewer:用 UML 审阅 agent 生成的项目 — blaizedsouza · 2026-09-22
- 渐进式披露:agent 代表人类社交时逐步释放信息的用法 — iamrobotbear · 2026-09-22
- Qwen 3.8 27b 微调版输出冗长减 40%,质量基本无损 — julianharris · 2026-09-22
- 用户抱怨 Codex 桌面端不显示 agent 执行了哪条命令 — amplifiedamp · 2026-09-22
- AWS 资深工程师长文:编程从来不是我的工作本身 — blaizedsouza · 2026-09-22