TwIL-LM2 小模型在严格形式推理上超越 Qwen3 和 Gemma4
HopefulMode429 · reddit · 2026-08-23
TwIL-LM2 (基于 SmolLM2-1.7B-Instruct 的 72M 参数 LoRA 适配器) 专注于将英语转换为逻辑求解器可校验的一阶逻辑,不处理通用推理或聊天。令人惊讶的是,在严格评分(无部分分数)的 strict-7 基准上,该 1.7B 模型得分 0.2386,超过了 Qwen3-8B (0.2093) 和 Gemma-4-26B (0.2050)。这表明专用小模型在特定管道步骤(如精确形式翻译)中可以优于大模型,适合作为大模型管道的专门组件。该项目遵循 webAI 非商业许可。
所属事件:1.7B 小模型 TwIL-LM2 严格逻辑推理击败 8B 大模型(2 条相关)→
「模型」频道最新
- 被吹捧为 SOTA 杀手的 Gemini 新模型实测翻车 — IndraVahan · 2026-08-23
- 为何 o3 模型不太可能源自 Cursor?技术博主列三大反证 — teortaxesTex · 2026-08-23
- 用户指控 OpenAI 主动破坏 Codex 编程体验 — Revolutionalredstone · 2026-08-23
- 开发者实测:Gemini 3.7 Flash 适合中低复杂度任务 — brandon_galang · 2026-08-23
- 评论称 Gemini 3.7 Flash 勉强支撑 Google 竞争力 — ishuagra02 · 2026-08-23
- Qwen3.5 27B 推出 12GB 显存 GGUF 量化版 — soyaakinohara · 2026-08-23