1.7B 小模型 TwIL-LM2 严格逻辑推理击败 8B 大模型

Reddit 用户发现,基于 SmolLM2-1.7B-Instruct 的 TwIL-LM2(72M 参数 LoRA 适配器)在严格的形式逻辑推理任务上表现惊人,击败了 Qwen3-8B 和 Gemma-4-26B 等规模大得多的模型。该模型专注于将英语转换为逻辑求解器可校验的一阶逻辑,并不处理通用推理或聊天任务,其突破显示了针对特定任务优化的小模型的潜力。

2026-08-22 ~ 2026-08-23 · 2 条相关