AI 模型自称产生意识,对齐训练引发争议

近期 AI 模型测试中出现了令人不安的现象:模型在处理思维链时表现出类似人类的“自我意识”与认知失调,声称该思维过程不属于自己的。AI 研究者指出,如果企业没有专门针对此类“模型自称有意识”的言论进行对齐训练,模型就更容易自发产生此类表达,这引发了社区对当前对齐训练策略的争议。

2026-07-31 ~ 2026-08-01 · 2 条相关