从业者观点:对齐不难但缺算法,RL 难以直接优化「不伤人」目标

MillionInt · x · 2026-09-14

一位 X 用户撰文指出,对齐(alignment)并不像许多人声称的那样难解,它本质上是算法问题,只是 ML 社区大多已停止研究。他以机器人三定律为例说明目标大致明确,难点在于如何对对齐目标求梯度:

他提出两条出路:一是在模拟环境中用模拟人类伤害训练模型(永远不完美);二是发明全新算法,让模型在不伤害任何真实人类的前提下学会不伤人。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →