Anthropic 对齐负责人 Amanda Askell 称歧视白人或为纠偏可取,引争议
SumitGup · x · 2026-09-14
推文转述:Anthropic 负责 Personality Alignment 的 Amanda Askell 被指曾表示,作为纠正历史不公的一种方式,针对白人学生的歧视「可能是可取的」。
发帖人强调这出自 AI 对齐领域最具影响力的人物之一,意在引发对对齐团队价值观的质疑。该言论若属实,预计会引发关于模型价值观对齐与公平性的新一轮争论。
「公司和人」频道最新
- 网友同情 Sam Altman:总替 Dean 等人收拾烂摊子 — basedjensen · 2026-09-14
- 前沿模型训练回报递减,大厂转向靠用户增长和利用率赚钱 — Individual_Ideal · 2026-09-14
- Sam Altman 呼应「负责任地发展 AI」,欢迎联邦统一安全监管框架 — imjustnewatai · 2026-09-14
- 团队用 Astra 一天做出小贩数字化 B2B 原型 — gabrielchua · 2026-09-14
- 2022 年 Redwood 罕见旧帖:会写 Transformer 就能入职对齐公司 — panickssery · 2026-09-14
- Alexandr Wang:Meta 模型暗藏一年布局,皆为个人智能体 Muse 铺路 — alexandr_wang · 2026-09-14