Chat template 会显著改变模型行为
stochasticchasm · x · 2026-07-22
一条技术回复解释了早期那则 GPT OSS 传闻为什么会出现:如果不用 chat template,模型可能会表现得很“跑偏”;但很多经过后训练的模型,在纯文本补全场景下仍然能工作得不错。
这不是新的 benchmark 结果,而是一个很实用的提醒:格式和提示约定会显著改变模型行为。
「模型」频道最新
- 谷歌推出 Gemini 3.6 Flash,并称 Gemini 4 已开始训练 — op7418 · 2026-07-22
- dots-note 3.0 据称在 IMO 2026 官方评卷中拿满分 — op7418 · 2026-07-22
- 观点:中国开源实验室追赶上前沿,因 OpenAI 等不再开放 — Wide_Egg_5814 · 2026-07-22
- Reddit 在问 MacBook M4 上哪款模型最不受限 — Neighbor_ · 2026-07-22
- 用户称 Fable 路由器总把请求降到 Opus 4.8 — sumitdotml · 2026-07-22
- Gemini 3.6 Flash 登陆 Antigravity,周配额同步重置 — haydendevs · 2026-07-22