零微调只看 logprob,LFM2.5 小模型读出实验对比 lev-350M
helloiamleonie · x · 2026-09-24
有开发者将 jaredpalmer 的 kev 移植到 Liquid AI 的 LFM2.5-350M,命名为 lev。另一位作者受此启发,用 llama.cpp 的单 token logprob 读出、不做任何微调或决策头,直接用基座模型概率测试:LFM2.5-350M 得 0.638,LFM2.5-2.6B 得 0.710,而 lev-350M 达 0.725。未经训练模型与 lev 的差距颇引人注意,说明仅靠基座概率读出已有不俗表现。
「模型」频道最新
- 法律案例幻觉基准:Gemma4:26b 险胜 Claude — MRGWONK · 2026-09-24
- 通用分类器 GPC-1 发布:毫秒级输出边界框、姿态与精确坐标 — anselm · 2026-09-24
- Reddit 基础科普:不同类型 AI 模型各自该在什么场景使用 — fuckme · 2026-09-24
- 29 款模型实测:DeepSeek 用 2% 成本拿下 93% 分数 — PieceKey2640 · 2026-09-24
- Sarvam Vision 2.1 发布:OCR 双榜 SOTA,支持 22 种印度语言手写识别 — itsOmSarraf_ · 2026-09-24
- Sunbird AI 发布 Sunflower v2:五个开源模型覆盖 67 种非洲语言 — lawrennd · 2026-09-24