Anthropic 过滤器引发争议:过度拦截还是必要权衡?

Raemon777 · x · 2026-08-19

用户 Raemon 针对 Anthropic 模型(Sonnet/Haiku 等)的安全过滤机制展开讨论。他认为虽然部分误判(如 Fable 到 Opus)令人烦恼,但核心过滤案例(如 NSFW 内容)正是该机制的应有之义。他反驳了“Anthropic 的任何妥协都是通往统治之路的错误”这一观点,认为这种指责缺乏依据,且在没有确切数据支持下无法断定当前的误报率权衡是错误的。

所属事件:Claude因特定词汇自动降级模型引争议(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →