Sonnet 误触"reasoning_extraction"拦截,用户一周额度被烧一半
marcandreewolf · reddit · 2026-10-01
一位有 4 年 LLM 使用经验的用户抱怨,在用 Claude 分析技术文档、撰写立法公众咨询反馈时,连续三次被 Anthropic 的 "reasoningextraction"(推理提取)拦截机制误伤。他检查过规则,prompt 和用户指令中并无任何涉及暴露内部思考的内容。
- 被 Opus 5.5 Extra 和 Sonnet 5.5 Max 先后拦截,另有一个完全不同 prompt 的分析任务也被拦
- 损失了每周限额的一半、15 美元额外积分和大量时间
- 已多次向 Anthropic 举报误拦,暂无回应
- 作者理解封堵系统性蒸馏的必要性,但认为误判机制存在问题,正考虑改用 GPT-6 Pro 完成
帖子反映了安全护栏误判对重度付费用户的实际成本,作者也在寻求绕过或替代方案。
「模型」频道最新
- ChatGPT Pro 500 档英国定价曝光:£445 约合 589 美元 — koltregaskes · 2026-10-02
- 开源编码 Agent Z-Engine:用 System 1 模型接管小决策 — arshadbarves · 2026-10-02
- 测试 8 个顶级模型:长周期经营任务 AI 仅达人类 27.3% 水平 — rohanpaul_ai · 2026-10-02
- ChatGPT 付费账号明早 10 点全球用量重置,GPT-6.1 恢复正常速度 — Angaisb_ · 2026-10-02
- 「Google 不会查证」背后:AI Overview 总结是否经过事实核查? — daluoseo · 2026-10-02
- 预测市场实测:Liquid AI 的 D1 分类器 12 类中赢 9 类 — JosephJacks_ · 2026-10-02