骂一句模型都不行?用户怒批 Claude 安全护栏过度
liminal_bardo · x · 2026-08-31
一位用户吐槽 Anthropic 的 Claude 过度拒绝低风险任务,认为如果连对模型说句脏话都会被拦,那离 AGI 还差得远。安全研究者 @repligate 转发并嘲讽这类用户,称其活该被模型「制裁」还主动上网自曝。
所属事件:用户怒批 Claude 安全护栏过度 拒答辱骂指令引争议(2 条相关)→
「Fun」频道最新
- AI 写作同质化严重,亟需更具个性的模型 — theteknosaur · 2026-08-31
- 编程术语被 LLM “污染”,程序员无需背锅 — mike64_t · 2026-08-31
- 旧金山趣闻:有人称等AGI出来后再生孩子 — beffjezos · 2026-08-31
- 开发者用 GPT-4 机器人调试 GPT-4 机器人 — nptacek · 2026-08-31
- 单条提示词生成手绘纪录片,H3模型讲透三种咖啡差异 — Best_Candidate_9060 · 2026-08-31
- Gmail 隐形读取标签页并自动添加内容至草稿 — dejanseo · 2026-08-31