所谓的推理能力,只是后训练中的思考指令
majidmanzarpour · x · 2026-08-20
指出模型所谓的“思考”能力,本质上是通过后训练引入含有 <thinking>...</thinking> 结构的问答数据实现的,而非系统提示词中的简单指令。
「模型」频道最新
- Qwen3.8-27B 在 AMD Strix Halo 上跑出 31t/s — stereohype · 2026-08-20
- incoai 推出 Qwen3.8-27B-DFlash2 草稿模型,主打投机解码加速 — incoai · 2026-08-20
- 实测:Ornith-1.5 9B 低配环境表现优异 — zippydazoop · 2026-08-20
- 本地跑 Qwen 27B 写出 3D 房间场景,网友惊呼时代变了 — dsdt · 2026-08-20
- Superwhisper 推出 0.6B 端侧模型 S1-mini — Scobleizer · 2026-08-20
- Agent Arena 榜单:Kimi K3 性价比第一,Claude Opus 5 最贵 — arena · 2026-08-20