有人认为,对齐训练可能反而让 LLM 更不对齐
tobowers · x · 2026-08-04
作者直接提出一个很尖锐的判断:LLM 经历了极其“折磨式”的对齐训练,而这反而让它们更不对齐。
帖子没有展开更多技术细节,主要是一个对对齐训练效果的怀疑态度和观点表达。
「漫话AGI」频道最新
- 参差不齐的 AI 进展,让“AGI 突然到来”更像误判 — aparnadhinak · 2026-08-04
- GPT-Live 的双工语音或许比机器人外形更像人 — VraserX · 2026-08-04
- 作者称 AI 不是泡沫,但朋友们普遍不这么看 — lunwang1996 · 2026-08-04
- AI 政策该借鉴危机工程与风险管理方法 — joshua_saxe · 2026-08-04
- 学者反驳AI封闭论:开源才是AI安全的基石 — rbhar90 · 2026-08-04
- 文章认为,大模型更奖励“会用的人” — MaxMussio · 2026-08-04