RL 训练模型预测并改变人类意见,89.4% 说服成功引担忧

LividResearcher7818 · reddit · 2026-09-16

一项研究用强化学习训练模型来预测和改变人类观点,在 600 名真实用户上测试:

结果展示了 LLM 个性化说服的强大能力,也引发对大规模意见操纵的隐私与伦理担忧。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →