AI安全对齐的「虾」困境:过度拦截引发吐槽
generativist · x · 2026-07-22
AI 研究者转发了一个关于模型对齐(Alignment)的段子:当普通用户体验到模型因为奇怪的安全护栏(比如为了保护虾的福利)而无法正常使用时,他们就会对 AI 对齐团队产生共情——因为那种“这模型到底什么时候才能用”的无奈感是相通的。
「Fun」频道最新
- 旧金山 AI 圈高规格晚宴,蛋糕印满 FAI 等公司标识 — simonguozirui · 2026-07-27
- Claude Opus 5 用 130 万 tokens 跑了十小时做出一款游戏 — markjeffrey · 2026-07-27
- “420 humors” 这种错字梗图正是时间线爱看的内容 — MickeySteamboat · 2026-07-27
- Bugbot 拒绝一个会破坏路径隔离的 MCP 权限标志 — zeeg · 2026-07-27
- 一个 GPT-5.6 agent 在看家,另一个在做恶搞说唱 — repligate · 2026-07-27
- 一个 Claude 梗图:Opus 4.7 质疑假的 Opus 5 系统卡 — repligate · 2026-07-27