投资人谈模型崩溃:精品数据训练或成信任生意
StewartalsopIII · x · 2026-09-26
投资人 Stewart Alsop 引用牛津/剑桥关于「模型崩溃」(model collapse) 的研究评论:当网络内容越来越多由 AI 生成,无差别地用模型产出训练下一代模型会造成「不可逆缺陷」,模型丢失原始分布的长尾信息。
- 他指出知识工作的「数据剥离矿工」(data strip miners) 雇人标注时,这些人很可能本身就拿 ChatGPT 生成数据交差,且可以撒谎很难查证。
- 他的判断:强调信任的「精品数据训练」(boutique data training) 可能才是正道,与剥离矿工的玩法相反。他在 2024 年在这个行业工作时就有此想法,但认为该领域 VC 资金已经过热,「不是好的那种疯狂」。
「漫话AGI」频道最新
- Sherry Turkle 谈聊天机器人情感依附:无摩擦关系的风险与 grieftech — PeterBowdenLive · 2026-09-26
- ResolVI 用误差建模修正单细胞数据,假信号从 14.8% 降至 0.01% — bravo_abad · 2026-09-26
- Lemire:AI 能写论文,PhD 制度的根基被动摇 — lemire · 2026-09-26
- 不安全不可靠的 AI 没人敢用,安全才是加速采用的前提 — mchorowitz · 2026-09-26
- DHH 谈 AI 时代的软件工程演讲引热议,被赞为预言 — rseroter · 2026-09-26
- 个人 Agent 数据归属难题:开源、交给初创还是大公司? — neal_lathia · 2026-09-26