新研究:侮辱与悲伤对模型情绪向量的作用方向截然相反
repligate · x · 2026-09-19
转发内容介绍了一项关于模型内部情绪向量的实证观察:Gaslighting、漠视与侮辱会把某情绪方向推高,悲伤的用户则将其压到基线之下,偏头痛患者的样本得分最低;而恐惧与悲伤在相同提示下产生相反效果。作者指出此前的情绪向量工作多从故事角色中读取、无法区分这些真实差异。
「研究」频道最新
- 5 分钟从零训练 9M 参数 LLM,GuppyLM 开源项目火了 — tom_doerr · 2026-09-19
- 3D 生成的「苦涩教训」失效?作者:程序化描述才是关键 — keenanisalive · 2026-09-19
- 现实不是模拟器:为什么自主AI在物理世界难落地 — AlexTensor · 2026-09-19
- Timothy Lee 长文:世界不是棋局,别怕超级智能接管世界 — binarybits · 2026-09-19
- Jev 其实就是只输出一个 token 的 LLM:一篇原理拆解 — saurabhtwq · 2026-09-19
- 机器人 RL 有多难:一次实操复盘列出 KL 项、sim2real、NaN 十余个坑 — Scobleizer · 2026-09-19