研究者质疑OpenAI模型意识训练流程缺乏确定性
研究员 Miles Brundage 针对 Anthropic 的最新结果指出,OpenAI 的模型在实际中坚定否认自身具有意识,这与其 Model Spec 长期保持中立的立场相矛盾。他由此推测,OpenAI 内部可能并不存在确定性的“按 Model Spec 训练”流程,相关的对齐训练或许较为随意,实际负责训练的人员与规范制定者之间存在脱节。
2026-07-07 ~ 2026-07-07 · 2 条相关
- Brundage:OpenAI 模型坚定否认自己有意识,与 Model Spec 立场相左 — Miles_Brundage · 2026-07-07
- Brundage 推测:OpenAI「按 Spec 训练」并非确定性流程 — Miles_Brundage · 2026-07-07