AI 会因数据污染而“逆向学习”吗?
pperSoc · reddit · 2026-08-22
用户提出了一个关于模型崩溃的理论问题:鉴于目前大量训练数据本身就是 AI 生成的,模型是否会因此“向后学习”?
支撑背景:
- Deezer 在 2025 年底前删除了至少 1300 万首 AI 生成歌曲。
- 超过 50% 的博客文章由 AI 生成或改写。
- 新上传的歌曲中超过 40% 是 AI 生成的。
用户担忧,当模型主要依赖这些合成数据进行再训练时,可能会出现不可预知的行为退化或偏差。
「模型」频道最新
- Whale-chain 测评:代码识别存在严重错误不可信 — teortaxesTex · 2026-08-22
- 神秘模型 Ox Alpha 现身:100 万上下文免费试用 — 1littlecoder · 2026-08-22
- Meta Muse Spark 1.2登陆OpenRouter:价格仅为GPT-5.6一半 — testingcatalog · 2026-08-22
- 爆料称 Ox Alpha 模型即 GLM-5.3,中美实验室差距缩小 — ccerrato147 · 2026-08-22
- 实测 0x-Alpha:仅为带视觉能力的 GLM 级模型 — bindureddy · 2026-08-22
- LLM 竟常将当今时代比作青铜时代晚期崩溃 — aiamblichus · 2026-08-22