Anthropic 蒸馏争议再起,模型训练数据已成混战
HankYeomans · x · 2026-07-24
- 这条帖子转引了一段围绕 Anthropic 与“蒸馏” 的争论,核心观点是:互联网里已经充满 AI 生成内容,模型训练时本来就在吸收一个“人类内容 + 其他模型输出”混合的生态。
- 引文里的批评者认为,Anthropic 一边指责别人蒸馏,一边又是基于“整个人类知识语料”训练,再把这些知识压缩后卖回给用户。
- 转发者则补充说,在 AI 内容充斥网络的前提下,模型之间相互“蒸馏”几乎成了新常态,追究单一模型的“纯度”意义有限。
- 这条更像是对AI 训练数据生态、模型互相污染与行业道德争议的观点辩论,而不是具体产品消息。
所属事件:AI行业蒸馏争议再起,被指反噬自身训练逻辑(2 条相关)→
「模型」频道最新
- 开权重模型让产品团队更能掌控成本、行为与部署 — MaziyarPanahi · 2026-07-24
- 开源包 trajectory 统一多家编码 Agent 会话格式 — carsonfarmer · 2026-07-24
- Baseten 在 Loops SDK 中加入 GLM-5.2 微调与生产部署 — baseten · 2026-07-24
- OpenAI GPT-5.6 三模型上线 Amazon Bedrock — AWS ML Blog · 2026-07-24
- Chrome 即将上线 Gemini 加持的自动填充 — SvetAndroida · 2026-07-24
- OpenAI 编码体验不错,但 Gemini 的速度更让人怀念 — burhop · 2026-07-24