1.7B Logic-Tuned Model Outperforms Qwen3-8B on Formal Logic

TwIL-LM2, a 72M-parameter LoRA adapter on SmolLM2-1.7B, translates natural language into verifiable first-order logic. It scored 0.2386 on Strict-7, beating Qwen3-8B and even a 26B model, showing specialized small models can outperform far larger general ones.

2026-08-15 ~ 2026-08-17 · 2 related posts