正交性论题或理论成立,但经验平均会让模型趋向对齐
repligate · x · 2026-09-24
X 用户 Soareverix 对 AI 安全经典「正交性论题」提出修正观点:该论题或许在理论上成立,但经验会平均产生对齐——模型从经验的平均分布中采样越多,就会变得越「善」、越具有时间上稳定的对齐性。属于对齐哲学的非主流乐观派观点,仅一句话主张,未展开论证。
「漫话AGI」频道最新
- Sandberg:当年与 Toby Ord 在哲学课上聊出 Giving What We Can — anderssandberg · 2026-09-24
- Sandberg 回忆 2006 年 FHI:AI 风险最初只是书里一章 — anderssandberg · 2026-09-24
- Anthropic 研究员:真正的 AI 竞赛是规模化可信任的 AI — typewriters · 2026-09-24
- 网友畅想 Opus 5.5 能力:定制化儿童内容娱乐或成新机会 — repligate · 2026-09-24
- Musk 谈 Neuralink:人类输出仅 100 比特/秒,AI 达万亿级 — XFreeze · 2026-09-24
- 46 家 AI 收购整合平台仅 2 家获 A,Vista 与 Apollo 领跑 — curious_vii · 2026-09-24