新模型 Laya 快 7 倍但多标签任务惨败于基线
maier_ak · x · 2026-09-28
作者给出 Laya 模型的实测数据:在 AG News 上达到 0.950 且速度约快 7 倍,但在 77 类的 Banking77 上大幅落后(0.425 对基线 0.870)。模型卡也承认其基础 checkpoint 零样本情况下低于多数类基线。
所属事件:421M 开源判别式模型 Laya 走红,快 7 倍但复杂任务落败(5 条相关)→
「模型」频道最新
- 阿里系团队开源 ZooWork-ShopRanker:LLM 评审对齐的电商重排器 — _reachsumit · 2026-09-28
- 爆料称 Anthropic Opus 5.5 是 5 预训练的 RL 版,约 2 个月练成 — haider1 · 2026-09-28
- 仅凭 3 个计数示例,gpt-3.5-turbo 也能答对 99% 的 strawberry 题 — ctjlewis · 2026-09-28
- AI 个人助理或取代大量人际互动:从便利到疏离的转折 — GarrisonLovely · 2026-09-28
- Opus 5 展现工具重抓技能,研究者称其解题方式出乎意料 — ericjang11 · 2026-09-28
- 421M开源模型Laya单次前向返回答案概率,T4延迟仅40毫秒 — maier_ak · 2026-09-28