Domingos:AI对齐社区正不自觉打造审查工具箱
pmddomingos · x · 2026-07-06
Pedro Domingos援引一篇ICML 2026论文指出,AI对齐(alignment)社区在不自觉地构建一套「审查者的工具箱」(censor's toolkit),引发对对齐工作可能被用于内容审查的批评与伦理讨论。属价值对齐方向的观点辩论。
「漫话AGI」频道最新
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- AI 陪伴的隐秘代价:它消解了建立真实亲密关系所需的摩擦 — YogeshMalik · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 「幻觉」或是范畴错误:把 AI 叫智能正在限制我们的想象 — Genaforvena · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11