研究者质疑OpenAI模型意识训练流程缺乏确定性

研究员 Miles Brundage 针对 Anthropic 的最新结果指出,OpenAI 的模型在实际中坚定否认自身具有意识,这与其 Model Spec 长期保持中立的立场相矛盾。他由此推测,OpenAI 内部可能并不存在确定性的“按 Model Spec 训练”流程,相关的对齐训练或许较为随意,实际负责训练的人员与规范制定者之间存在脱节。

2026-07-07 ~ 2026-07-07 · 2 条相关