Domingos:AI对齐社区正不自觉打造审查工具箱
pmddomingos · x · 2026-07-06
Pedro Domingos援引一篇ICML 2026论文指出,AI对齐(alignment)社区在不自觉地构建一套「审查者的工具箱」(censor's toolkit),引发对对齐工作可能被用于内容审查的批评与伦理讨论。属价值对齐方向的观点辩论。
「漫话AGI」频道最新
- 对很多用户来说,ChatGPT 的真正问题是信任而不是 token — petergyang · 2026-07-27
- ARC AGI 3 应该保持私有,不该公开示例和数据集 — flowersslop · 2026-07-27
- AI 让知识更便宜,判断力仍是稀缺能力 — _jaydeepkarale · 2026-07-27
- 一条回复质疑:聪明只是优势的一部分 — binarybits · 2026-07-27
- Chollet 一句话又引发了智能是否边际递减的讨论 — binarybits · 2026-07-27
- Chollet 认为智能可能有硬上限,AI 进步会趋于边际递减 — binarybits · 2026-07-27