骂一句模型都不行?用户怒批 Claude 安全护栏过度

liminal_bardo · x · 2026-08-31

一位用户吐槽 Anthropic 的 Claude 过度拒绝低风险任务,认为如果连对模型说句脏话都会被拦,那离 AGI 还差得远。安全研究者 @repligate 转发并嘲讽这类用户,称其活该被模型「制裁」还主动上网自曝。

所属事件:用户怒批 Claude 安全护栏过度 拒答辱骂指令引争议(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →