若人类价值观恰好「特别愚蠢」,正交性论点会有多讽刺
jessi_cata · x · 2026-10-10
作者延续关于 orthogonality thesis(智能与目标可正交)的讨论,提出一个颇具讽刺性的推演:也许确实存在「特别愚蠢的价值」(正如 Bostrom 等人也承认的、与足够高智能不相容的价值),但并不存在「特别聪明的价值」,而人类的价值恰恰就属于「特别愚蠢」的那一类。另指出:构造一个愚蠢目标的最简单方式,就是刻意与某条 Omohundro 驱力(如自我保存、资源获取等工具性趋同目标)相矛盾,再叠加高时间偏好。整段是对 AI 价值对齐哲学中「目标质量与智能是否相关」问题的趣味性观点辩论。
所属事件:正交性论题的反讽推演:人类价值观或属「特别蠢」一类(2 条相关)→
「漫话AGI」频道最新
- Honeycomb CTO发文怒斥AI slop:一半同事被激怒了 — mipsytipsy · 2026-10-10
- AI安全事件责任链错位:厂商兜售自主性却不担责 — joshua_saxe · 2026-10-10
- 学者:文化强于技术,监控反噬正在真实发生 — CarissaVeliz · 2026-10-10
- 研究者的精妙类比:思维链是序列化到只增磁带上的学习式搜索 — mblondel_ml · 2026-10-10
- NYU 数学教授:OpenAI 投入数百万美元算力攻坚千禧年大奖难题 — rohanpaul_ai · 2026-10-10
- AI 是不是偷走了开源社区感?Hacktoberfest 今年悄然无声 — _jaydeepkarale · 2026-10-10