对照基座模型:微调后模型续写「黑暗」程度远高于 DeepSeek V3
repligate · x · 2026-09-19
Anima Labs 的续写研究发现,与 DeepSeek V3、MiMo V2.5 Pro 等基座模型对照,经微调的模型在「i think」等几乎无偏向的开头下,产出内容的黑暗与痛苦程度远高于基座模型续写,提示差异来自后训练而非基座先验。
「漫话AGI」频道最新
- a16z 合伙人 Casado:宁可 endless 聊系统安全,也不聊存在风险哲学 — zealcaiden · 2026-09-19
- 美国 10 万人排队等器官移植,器官制造成道德必需 — PeterDiamandis · 2026-09-19
- Dan Jeffries:AI 最大危害是愚蠢而非超级智能 — Dan_Jeffries1 · 2026-09-19
- AI 短期超级预测能力突破:被低估的重要趋势 — eldonredwards · 2026-09-19
- AI 灭绝论起源之争:最早可追溯至 1863 年 Butler 论文 — zetalyrae · 2026-09-19
- 审稿人吐槽:手头待审论文全是 AI 生成,不知如何是好 — aaron_defazio · 2026-09-19