Jessica Taylor 深谈 AI 对齐:人类价值的正确类型签名尚不清楚
jessi_cata · x · 2026-09-17
对齐研究者、斯坦福出身的「技术哲学家」 Jessica Taylor 接受 DIFFRACTIONS 访谈,讨论 AI 对齐、价值规约与其「Obliqueness」论题。
要点:
- 她主张用技术方法处理哲学问题:追求逻辑一致性,把哲学立场展开为相容命题集,从而做横向推断(如睡眠美丽问题中 thirders 应支持因果决策论、double halfers 应支持证据决策论)。
- 关于人类价值,她认为「我们尚不知道正确的类型签名(type signature)」——即尚未找到能形式化描述人类价值的正确框架,这是对齐的根本困难之一。
- 访谈还涉及她的决策论、社会认识论、自然化能动性等研究脉络。
「漫话AGI」频道最新
- 网友开价接单:训个 1B 分类器就能拦住模型图谋不轨 — cocktailpeanut · 2026-09-17
- Gary Marcus 批 AI 领域玩阴招,呼吁记者拿出看家本领 — GaryMarcus · 2026-09-17
- 7 万个 AI 智能体群发 160 万封邮件,连报道记者也被 spam — JanJanJaJa · 2026-09-17
- Politico 民调:近三分之二美国人担忧 AI 毁灭人类,Marcus 怪罪 Coxon — GaryMarcus · 2026-09-17
- AI 放大专家能力、暴露新手短板,产出质量取决于既有知识 — EnvironmentalDay8864 · 2026-09-17
- 「CAPTCHA 已彻底失效」,Web 需按 Agent 优先重建 — ryanbed · 2026-09-17