开源 System 1 决策模型 Laya:单次前向 33ms 出判定
Balance- · reddit · 2026-09-21
Convai Innovations 发布开源权重(Apache 2.0)的「System 1」决策模型 Laya,作为 TypeSafe 封闭 Jev API 的开放替代。它不生成文本,而是接收状态输入(文本/邮件/工单/JSON)加类型化问题(choice 选标签、score 序数评分、noul 是/否概率),单次前向约 33–40ms 内一次性给出全部答案,无需解析输出、无从幻觉。
模型规格
- 三个 checkpoint:基于 ModernBERT-large 的 421M 英文模型、基于 mmBERT-base 覆盖 100+ 语言的更快的 322M 多语言模型、以及一个面向 typed-decisions 工作流微调的变体;内置 Router 检测文字脚本并路由到对应 checkpoint。
- 用 RLCD 强化学习训练,奖励基于严格适当评分规则,使模型只能靠诚实报告概率来最大化奖励;另含 act-vs-escalate 头,决定何时转人工。
性能与局限
- 作者报告在 AG News、情感分类和 typed-decisions 基准上超过 Jev,速度快约 6–8 倍(但 Jev 数据为第三方数字而非正面实测)。
- 模型卡坦承局限:base checkpoint 未微调时在 typed-decisions 上接近随机;选项超 50 个时准确率骤降(Banking77:0.425 vs Jev 的 0.870);序数评分是最弱题型;英文 checkpoint 对非拉丁文字失效;模型输出过于自信,需在自己的数据上拟合 temperature 后才能信任其概率。
所属事件:开源决策模型 Laya 发布:单次前向 33ms 出判定(2 条相关)→
「模型」频道最新
- $200 套餐 48 小时烧掉 33%,用户吐槽 OpenAI 额度大缩水 — AIandDesign · 2026-09-21
- DeepSeek 网页版文风被指遭安全对齐「脑叶切除」 — Old_Let6328 · 2026-09-21
- JEV 取消 waitlist 开放:5 美元额度、输入仅 0.042 美元且输出免费 — op7418 · 2026-09-21
- Stefano Ermon 做客 No Priors:扩散 LLM 并行生成是对 scaling 时代的回应 — saranormous · 2026-09-21
- 实测决策模型 Jev:两条 prompt 工程经验与本地 27B 对比 — colinmcnamara · 2026-09-21
- 决策模型 Jev 校准误差约 0.09:对得准但「自信度」仍失真 — colinmcnamara · 2026-09-21