1.7B 专用模型攻形式逻辑,击败 Qwen3-8B

TwIL-LM2 是基于 SmolLM2-1.7B 的 LoRA 微调模型(7200 万参数),专司将自然语言转换为可验证的一阶逻辑,不做通用任务。其在严格形式逻辑翻译任务上的 Strict-7 得分为 0.2386,超越 Qwen3-8B,甚至击败 26B 大模型,显示出专用小模型在垂直任务上的潜力。

2026-08-15 ~ 2026-08-17 · 2 条相关