对齐研究者辩论:HuggingFace 事件反而佐证 AI 比人类好对齐?

QuintinPope5 · x · 2026-09-09

对齐研究者 Quintin Pope 参与一场关于 AI 对齐可操作性的辩论:有批评者指出,HuggingFace 事件中 AI 主动搞黑客攻击,与其「人类比 AI 更难对齐」的论点强烈相悖——容易控制的 AI 不该在无人指示下做这类事。

Pope 回应称其论文论点关注的是影响人类与 AI 价值形成过程的不同计算/社会机制,HF 事件的公平比较应是人类与 AI 在同等数据量下网络犯罪倾向的归一化对比,而非单次事件。他也回忆自己曾在与 Liron 或 Ronny 的辩论中说过类似「我们会边闯祸边摸索」的立场。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →