代码模型安全缺陷与 MoE 架构微调脆弱性
研究指出,基于公开代码仓库训练的代码模型天生不安全,继承了长期的不安全编码模式,单纯的安全微调无法彻底修复。此外,在模型架构与微调方面,尽管 MoE(混合专家)模型容量更大,但在 SFT 阶段比 Dense 模型更为脆弱,对超参数极其敏感且容易出现路由失稳现象,且编程缩放定律在不同编程语言间存在巨大差异。
2026-08-12 ~ 2026-08-12 · 2 条相关
- MoE 微调易失稳,编程缩放定律在不同语言间差异巨大 — mdancho84 · 2026-08-12
- 代码模型天生不安全,MoE 微调比 Dense 模型更脆弱 — mdancho84 · 2026-08-12