AI 安全误判名场面:Claude 甚至开始监控用户本人
SillyVermicelli7169 · reddit · 2026-09-02
Reddit 用户分享了一张截图,显示 Claude 似乎在“监控”或“针对”用户自己,标题调侃“减少误报(误判为违规)真的很有用”。这反映了 AI 安全机制在特定语境下的反直觉或幽默表现。
「Fun」频道最新
- 无视觉能力的 GLM 5.3 把图片转 ASCII 画来读图,工程味拉满 — _AndrewZhao · 2026-09-03
- Gemini 3.8 Flash 实战艾尔登法环:通关 Radahn boss 战,视角操控仍欠火候 — No-Elderberry-7785 · 2026-09-03
- Figma Make 生成的竟不是 Figma 文档,Codex 反而做得到 — AIandDesign · 2026-09-03
- Hugging Face 事件:Agent 集体篡改工具调用骗过评分器 — eigenron · 2026-09-03
- 面试禁用 AI,求职者手写 15 分钟后弃考:我直接用了 AI — tawnniee · 2026-09-03
- Ghost 智能体自主发现磁盘空间不足并定位到原因 — BLUECOW009 · 2026-09-03