研究者回应 Bengio:人类自己都没对齐,谈何 AI 对齐

在回应图灵奖得主 Yoshua Bengio 时,开发者 kwangmooyi 提出不同看法:大家可能在想错问题——在讨论「AI 对齐」之前,应当先承认人类从未成功实现「人类对齐」。他还指出,如果把 AI 模型视为智能实体,对齐问题也未必会因此变得更容易。这一观点将 AI 安全讨论引向对人类自身协作与价值分歧的反思,引发热议。

2026-09-12 ~ 2026-09-12 · 2 条相关

另有 1 条近重复转述:kwangmoo_yi