Anthropic 恢复对安全拦截请求收费:99.7% 用户不受影响
ClaudeDevs · x · 2026-09-25
Anthropic 官宣恢复对「响应前被安全护栏拦截的请求」计费,仅限误报率低的类别:生物安全、蒸馏攻击、前沿 LLM 开发。公司称近期遭遇协同攻击,此举是防御层之一。官方数据显示:99.7% 的 Claude Code、Claude.ai、Cowork 用户不会命中这类「计费拦截」;相关分类器误报率调校在 0.1% 以下,并承诺持续优化。被误拦可通过 Claude Code 的 /feedback 反馈。这是厂商首次公开把「安全拦截」纳入计费口径,引发对计费透明度的关注。
「模型」频道最新
- 创业者预测:新一代 GPT 与 Claude 发布将重现 GPT-4、Sonnet 3.5 时刻 — kieranklaassen · 2026-09-25
- 调高 Claude effort 档位换来更充分的思考与验证预算 — every · 2026-09-25
- Proteus 入选 NeurIPS 2026:分块解锁记忆上限提升 8.4 NIAH — behrouz_ali · 2026-09-25
- LangSmith 推出微调功能:用 agent 轨迹一键训练专用模型 — LangChain · 2026-09-25
- Pro 订阅版「xhigh latest」被吐槽仅 Qwen 级水平 — teortaxesTex · 2026-09-25
- AIRA₂ 研究智能体登顶 MLE-bench,81.5% 胜人类基线 72.7% — mariofilhoml · 2026-09-25