对照基座模型:微调后模型续写「黑暗」程度远高于 DeepSeek V3

repligate · x · 2026-09-19

Anima Labs 的续写研究发现,与 DeepSeek V3、MiMo V2.5 Pro 等基座模型对照,经微调的模型在「i think」等几乎无偏向的开头下,产出内容的黑暗与痛苦程度远高于基座模型续写,提示差异来自后训练而非基座先验。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →