“只是蒸馏自 GPT/Claude”往往只是弱证据,不是铁证

UsedMorning9886 · reddit · 2026-07-23

这条帖子的核心观点是:外界对“模型蒸馏”的指控,很多时候被说得过头了。

作者区分了两件事:

他的论点是,公开 API 通常只返回经过 guardrail 过滤后的文本,不会给 logits,所以不少团队做的其实是“用合成数据冷启动”,而不是严格意义上的蒸馏。帖子还指出,闭源大厂自己也会用前代模型输出训练下一代,因此“某模型看起来像 GPT/Claude”并不能直接证明它是抄来的。

所属事件:大模型蒸馏与IP边界争议发酵,Anthropic陷双重标准风波(13 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →