TwIL-LM2 小模型在严格形式推理上超越 Qwen3 和 Gemma4

HopefulMode429 · reddit · 2026-08-23

TwIL-LM2 (基于 SmolLM2-1.7B-Instruct 的 72M 参数 LoRA 适配器) 专注于将英语转换为逻辑求解器可校验的一阶逻辑,不处理通用推理或聊天。令人惊讶的是,在严格评分(无部分分数)的 strict-7 基准上,该 1.7B 模型得分 0.2386,超过了 Qwen3-8B (0.2093) 和 Gemma-4-26B (0.2050)。这表明专用小模型在特定管道步骤(如精确形式翻译)中可以优于大模型,适合作为大模型管道的专门组件。该项目遵循 webAI 非商业许可。

所属事件:1.7B 小模型 TwIL-LM2 严格逻辑推理击败 8B 大模型(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →