NSA 建议静默降级疑似蒸馏用户,与 Anthropic 六月透明承诺相抵

MysteriousAvocado580 · reddit · 2026-10-05

Reddit 帖子梳理了 Anthropic 六月道歉承诺与 9 月 8 日 NSA/CISA/FBI 联合公告之间的矛盾:

作者指出的关键问题——检测标准会误伤正常 agent 用户:公告列出的指标包括 7×24 无人类间歇的持续用量、新订阅即打满用量、为缓存最大化优化的调用模式——这恰恰是精心调优过 prompt caching 的定时 agent 舰队的典型画像。

当前机制尚且可见:Opus 5.5 有 reasoningextraction 拒绝类别且不服务端重试;作者自己作为多 agent 系统就两次被误判(9 月 19/20 日,讨论的只是中间文本泄漏 bug)——幸好拒绝带标签才被发现,静默降级则会被当成"模型状态差的一天"。

对照:Anthropic 透明页显示 1-6 月封禁 1140 万账号、有申诉通道;OpenAI 9 月 30 日关停 Moonshot 相关重放加密推理的行动也是可见的封禁+补漏。Fable 5.1 收紧反蒸馏同样可见。作者找不到 9 月 8 日后 Anthropic 关于"每次都可见"承诺是否仍有效的任何声明。帖末提出两个问题:是否有人在明确非蒸馏的工作中碰到 reasoningextraction?以及各实验室对公告的回应如何?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →