用户称 Gemini 把「有人要杀我」误判成自杀倾向,只回热线清单
WideImagination8644 · reddit · 2026-09-22
Reddit 用户反映,向 Google Gemini 描述「有人想杀我」时,模型反复返回自杀求助热线清单;发帖人重复追问原因,仍未提及自杀或自伤,模型依旧输出同一类回复。这是安全护栏关键词误匹配的典型翻车案例,显示当前安全机制在「外部威胁」与「自我伤害」语境区分上的缺陷。
「模型」频道最新
- 曝 DeepSeek 押注华为芯片训练新模型,梁文锋称「必须成」 — kimmonismus · 2026-09-22
- 小米 MiMo-V2.6-Pro 登顶开源模型,Anthropic 指其蒸馏 Claude 数据 — The Decoder · 2026-09-22
- 腾讯开放微信接口,上百 G 聊天数据处理终于可行 — Xianbao_QIAN · 2026-09-22
- 小米 MiMo-V2.6-Pro 实测修 105 个真实 bug:性价比突出 — PawelHuryn · 2026-09-22
- ChatGPT Pro 用户控诉 GPT-5.6 以「防滥用」之名暗中降质 — princeMacX · 2026-09-22
- 选 Claude 不再只是技术题:Haiku/Sonnet/Opus 该怎么选 — goyalshaliniuk · 2026-09-22