追踪共享专家溯源:无规模化证据,或损害后训练对齐性

menhguin · x · 2026-10-07

作者在可解释性预训练提案中探索一个理论:中文开源模型常见的共享专家(shared experts)可能降低后训练的有效性与模型可对齐性。

核心论点:

所属事件:研究称共享专家架构或损害中文开源模型后训练对齐性(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →