对齐争论:模型是随语境变化的分布,「当前技术下对齐不可能」
gerardsans · x · 2026-09-18
@gerardsans 回应 @stevesi 时提出一个对齐哲学观点:对齐的前提假设「存在一个可被对齐的固定对象」,但模型本质是数学意义上的分布,其行为随语境变化而非固定特质,因此在当前技术下对齐是不可能的。他补充称模型「不会出 bug,因为它是概率性的,行为完全符合设计」。
所属事件:统计学者称 LLM 本质是分布,当前对齐不可能(2 条相关)→
「漫话AGI」频道最新
- Runway CEO:前沿正从生成内容转向按需生成整个世界 — c_valenzuelab · 2026-09-18
- 用专用超智能专门解决对齐问题?Reddit 上的新思路 — fullcongoblast · 2026-09-18
- VC 观点:欧洲输在造不出融资机制,而非造不出 AI — inductionheads · 2026-09-18
- 牛津剑桥研究:第 9 代自噬训练后模型彻底崩溃,留 10% 真实数据可止损 — alex_verem · 2026-09-18
- 前计算语言学者感叹:数学家对 LLM 的反应远胜同行 — voooooogel · 2026-09-18
- 微软 AI CEO Suleyman:AI 或成新「硅基物种」,失控风险真实存在 — rohanpaul_ai · 2026-09-18