Dirty Token 致模型异常:训练分词病理所致
teortaxesTex · x · 2026-08-21
有特定子串会让多数模型正常处理,却导致某些模型出现异常行为。这种现象非常具体,取决于模型和分词器,并与训练词元匹配这些子串时的某种病理有关。
所属事件:DeepSeek-V3被曝异常Token致诡异输出(2 条相关)→
「模型」频道最新
- 智谱 SAO 论文:单采样异步 RL 稳定训练千步,超越 GRPO — teortaxesTex · 2026-08-21
- Gemini 安全审查过严?连亲吻和公路拍照都拒 — Dry-Sympathy-3182 · 2026-08-21
- 0.63M 参数验证器媲美 7B 模型,AI 推理新极限 — jm_alexia · 2026-08-21
- Pangram v4 模型声称能移除 AI 水印并伪成人类写作 — Scobleizer · 2026-08-21
- Brundage 观察:ChatGPT 推理疑似异常,或为内部测试 — Miles_Brundage · 2026-08-21
- Claude 的「家话」更好用?网友呼吁实测证明 — voooooogel · 2026-08-21