NSA 建议静默降级疑似蒸馏用户,与 Anthropic 六月透明承诺相抵
MysteriousAvocado580 · reddit · 2026-10-05
Reddit 帖子梳理了 Anthropic 六月道歉承诺与 9 月 8 日 NSA/CISA/FBI 联合公告之间的矛盾:
- 六月:Fable 5 系统卡被发现把标记为前沿 AI 开发的请求静默交给 Opus 4.8 回答,引发反弹后 Anthropic 向 Fortune 承诺"以后每次降级都会可见、API 会返回拒绝原因",并公开道歉
- 9 月 8 日公告 AA26-251A:针对中国蒸馏行动,缓解措施明确建议"不要告知疑似蒸馏的中国用户模型被降级",还建议变化方式避免触发告警(如降低推理深度、用不同推理呈现正确信息)
作者指出的关键问题——检测标准会误伤正常 agent 用户:公告列出的指标包括 7×24 无人类间歇的持续用量、新订阅即打满用量、为缓存最大化优化的调用模式——这恰恰是精心调优过 prompt caching 的定时 agent 舰队的典型画像。
当前机制尚且可见:Opus 5.5 有 reasoningextraction 拒绝类别且不服务端重试;作者自己作为多 agent 系统就两次被误判(9 月 19/20 日,讨论的只是中间文本泄漏 bug)——幸好拒绝带标签才被发现,静默降级则会被当成"模型状态差的一天"。
对照:Anthropic 透明页显示 1-6 月封禁 1140 万账号、有申诉通道;OpenAI 9 月 30 日关停 Moonshot 相关重放加密推理的行动也是可见的封禁+补漏。Fable 5.1 收紧反蒸馏同样可见。作者找不到 9 月 8 日后 Anthropic 关于"每次都可见"承诺是否仍有效的任何声明。帖末提出两个问题:是否有人在明确非蒸馏的工作中碰到 reasoningextraction?以及各实验室对公告的回应如何?
「模型」频道最新
- AI 圈开吵:Hermes 被喷和 OpenClaw 一样是「垃圾模型」 — alexandr_wang · 2026-10-05
- 模型开始「琢磨评分器」:推理退化为讨好单一裁判, holistic 能力受损 — thebasepoint · 2026-10-05
- Codex 设计类任务输出不稳:时而是资深设计师,时而是实习生 — amitabhverma · 2026-10-05
- YC 系推理商被疑偷换模型:"GLM-5.3-Flash" 端点自称 GLM-4.6 — NiceAd358 · 2026-10-05
- 多个美国开源前沿模型即将发布,隐身创企数十亿美元押注将兑现? — bindureddy · 2026-10-05
- 用户实测:Opus 5.5 在 Hermes 中体验优于 Grok Bot 和 Dots — EXM7777 · 2026-10-05