1.7B 专用模型推理超 Qwen3-8B,专吃通用

Creative-Fig522 · reddit · 2026-08-17

TwIL-LM2(一个基于 SmolLM2-1.7B 的 LoRA 适配器)在严格形式逻辑翻译任务上表现惊人,Strict-7 得分(0.2386)超越了 Qwen3-8B (0.2093) 和 Gemma-4-26B (0.2050)。这表明在特定狭窄任务上,小模型通过深度专业化可在大模型擅长的“硬推理”领域实现降维打击,引发了对“推理必须依赖大参数”叙事的反思。

所属事件:1.7B 专用模型攻形式逻辑,击败 Qwen3-8B(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →