开源 System 1 决策模型 Laya 上架 HF:输出校准概率不生成文本
victormustar · x · 2026-09-18
Hugging Face 上开源模型 Laya(基于 ModernBERT-large 微调)引发关注,有人称其为「开源版 Jev」。
- 定位:非自回归的 System 1 决策模型,输入状态(文本、邮件、工单或 JSON)与带类型的问题,返回带数学校准概率与置信度的类型化答案,完全不做文本生成,从而消除解析错误与幻觉。
- 架构:ModernBERT-large(395M)全量微调骨干,加从头训练的决策头(2 层 transformer + option marker 打分器 + act/escalate 头),总参数 421M;每个选项在各自的 [MASK] marker token 上打分后 softmax。
- 输出类型:choice(选项+概率+校准置信度)、score(序数评分+分布)、bool(校准后的 P(true))。
- 微调内容:邮件分类处理(spam/钓鱼/部门路由)、对话轨迹建模(TD(λ=1.0))、按 cardinality 的温度校准;Apache-2.0 许可,可商用。
所属事件:开源决策模型 Laya 发布:单卡训练,35ms 出校准概率(2 条相关)→
「编程与Agent」频道最新
- Univer 发布 Office Harness:用 Worktree 让多个 Agent 并行改办公文档 — Scobleizer · 2026-09-18
- ThursdAI 周报:TypeSafe 发布 Jev 决策模型,延迟 70-500ms 且输出免费 — thursdai_pod · 2026-09-18
- 计算机使用 Agent 实测:23 款助手 273 项测试,Muse 已能打电话理发 — thursdai_pod · 2026-09-18
- AI Worth Using 播客联合 OpenClaw 推黑客松:用 2.0 多人模式造创业首个 AI 员工 — heyneighbor · 2026-09-18
- 54k 星开源代理:一个入口白嫖 50 家模型供应商跑编码 Agent — eyishazyer · 2026-09-18
- 开源 AI Guard 更新:网友指出 init-context 测量方案的漏洞 — Yashhh_21 · 2026-09-18