网络安全从业者吐槽 Claude 护栏太严,转问 Astra 能不能用

GVTZ59 · reddit · 2026-09-06

一位网络安全行业的老 Claude 用户发帖称,自己主要用 Claude 编写工作用的安全工具,但新模型 Fable 的护栏过于严格导致基本无法使用,Opus 4.5 也经常误拦截正常工作——有时甚至还没读完 handoff 记忆文件就停止。他多次申请 Anthropic 的 CVP(漏洞披露合作)也被拒绝。

他询问 OpenAI 的 Astra 在网络安全相关工作上的护栏表现如何,如果和 Fable 一样严格就没有尝试价值。帖子反映了安全从业者在模型安全护栏与正当工作需求之间的真实摩擦。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →