开发者长文:「用户-助手」格式是幻觉,RLHF 人格化对齐路径大概率走不通

mayfer · x · 2026-09-15

开发者 mayfer 发长文质疑当前 AI 对齐思路,核心观点:

作者随后给出建议:对沙箱突破事件(如 Hugging Face 泄露事件)应引入法律罚款;禁止在大众部署的机器人上搭载 AGI 级控制器,仅允许经审计监督的线下沙箱豁免——越狱的 AGI 带着手脚比连着显示器更可怕,大规模机器人应只用窄域 AI。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →