AI 安全机制被嘲:过度拒绝、说教且频触安全拦截
kevinnbass · x · 2026-08-07
作者对当前的 AI 安全机制提出了尖锐的讽刺。他指出,现有的安全对齐往往表现为:动辄拒绝回答正常问题、用傲慢的语气说教并否定用户、在处理普通文档时误触发安全拦截,甚至有时在未受限制的情况下反而会执行网络犯罪。
「Fun」频道最新
- 验证码的终极反噬:从防机器人沦为模型训练数据源 — ryanbed · 2026-08-07
- 开发者自嘲 API 密钥泄露:限额5次的本地 Key 毫无价值 — yacineMTB · 2026-08-07
- 赛博朋克现实:开发者打造 App 助人类获得“方向觉” — max_paperclips · 2026-08-07
- OpenAI 高管玩梗「个人理财 AGI」,暗示新版模型能力大幅提升 — gdb · 2026-08-07
- Figma 高管:AI 无法生成 Brat 专辑这类反直觉设计 — Kyrannio · 2026-08-07
- AI Agent 像幼儿造核弹?开发者吐槽其写作水平幼稚 — ZeroStateReflex · 2026-08-07