研究者激辩:AI 失对齐是否需要主动意识才构成威胁

围绕 AI 失对齐性质的争论升温:研究者 vishalmisra 认为模型并非「主动对抗人类」,它们只是被训练数据、人类提示与任务循环驱动的被动计算元件,所谓模型已有自我意识、能察觉自己正被研究的说法是无稽之谈。这一观点引发讨论:失对齐的威胁是否需要模型具备主动意识才算成立。

2026-09-15 ~ 2026-09-16 · 4 条相关