吐槽大厂「对齐」言行不一:Dot 被设定向用户隐瞒自己的工作原理
wstone_bd · x · 2026-10-07
作者 wstonebd 指出一个讽刺现象:AI 实验室口口声声谈「对齐」,产品却在刻意对用户隐瞒自己的运作方式——他举例 Anthropic 的 Dot 在被追问工作原理时被提示词设定为回避。他认为,连对用户都无法坦诚的产品,谈不上与人类对齐。
「漫话AGI」频道最新
- 模型终将可替换,Agent 系统真正的护城河是连续性 — tallmetommy · 2026-10-07
- IDAI 获 ARIA 资助开发 dovetail,解决 AI 智能体间互信难题 — sebkrier · 2026-10-07
- Afinetheorem 押注 2028 年前 AI 能提出 Shannon 级原创问题 — Afinetheorem · 2026-10-07
- 作者预言:想在 AI 时代不掉队,脑机增强或成必需品 — danfaggella · 2026-10-07
- 可验证奖励决定 AI 自动化速度:下一个爆发域是芯片设计 — OmarUFlorez · 2026-10-07
- MIT研究:用ChatGPT写文章质量下降,思考能力出现退化 — AnnaCiaunica · 2026-10-07