RTX 4090 实测四款开源决策模型:Laya 最快,Lev 最准但慢 13 倍

Fun-Meaning-6474 · reddit · 2026-10-09

作者对近两周涌现的四款开源决策模型(Laya、Liquid d1 3B、Cloudflare Clef-Flash 9B、Interfaze Lev 4B)在单张 RTX 4090 上做同任务横评:逐词读 9 篇维基百科蜈蚣条目并标注蜈蚣名称。

结果要点

作者结论:Laya 综合最快且易微调,是首选。文中给出完整复现配置(llama.cpp b11495、CUDA 12.8、-ngl 99、各模型量化文件与引擎)。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →