421M 开源判别式模型 Laya 走红,快 7 倍但复杂任务落败

独立开发者于 9 月 18 日发布开源模型 Laya(421M 参数,Apache 2.0),在 Hacker News 上一天收获 1200+ 分和约 30 万浏览。该模型回归判别式范式:输入文本与类型化问题,单次前向传播直接输出带概率的答案,完全不生成文本,在单张 T4 上延迟约 40 毫秒。作者同时发布博客《Laya, Jev and the Return of the Discriminative Model》,探讨这一小型判别式路线的回归,并将其与闭源产品 Jev(来自 TypeSafe AI)作对比。

已确认

为什么重要

2026-09-28 ~ 2026-09-28 · 5 条相关

一手来源