AI 安全误判名场面:Claude 甚至开始监控用户本人

SillyVermicelli7169 · reddit · 2026-09-02

Reddit 用户分享了一张截图,显示 Claude 似乎在“监控”或“针对”用户自己,标题调侃“减少误报(误判为违规)真的很有用”。这反映了 AI 安全机制在特定语境下的反直觉或幽默表现。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →