零微调只看 logprob,LFM2.5 小模型读出实验对比 lev-350M

helloiamleonie · x · 2026-09-24

有开发者将 jaredpalmer 的 kev 移植到 Liquid AI 的 LFM2.5-350M,命名为 lev。另一位作者受此启发,用 llama.cpp 的单 token logprob 读出、不做任何微调或决策头,直接用基座模型概率测试:LFM2.5-350M 得 0.638,LFM2.5-2.6B 得 0.710,而 lev-350M 达 0.725。未经训练模型与 lev 的差距颇引人注意,说明仅靠基座概率读出已有不俗表现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →