AI军备竞赛转向数据争夺:旧书成高质量训练新宠
Olivier__OG · x · 2026-07-31
随着公共互联网数据被AI生成内容污染,AI行业的竞争焦点正从模型转向稀缺的人类生成数据。旧书因出版于互联网泛滥前,数据更纯净,成为极具价值的训练素材。
报道显示,Anthropic等公司正通过扫描实体书建立私有数据集,甚至不惜销毁原书。这表明,掌握独特、高质量的数据正成为企业间真正的护城河,未来AI的优势将属于拥有最干净、最稀缺数据的公司。
「漫话AGI」频道最新
- Dwarkesh 预测算力成本或暴涨 10 倍:单张 H100 价值将达 25 万美元 — rohanpaul_ai · 2026-07-31
- Anthropic 安全测试引争议:隐瞒环境或致模型行为异化 — liminal_bardo · 2026-07-31
- OpenAI 招聘广告引争议,被指只谈愿景忽视安全 — davidmanheim · 2026-07-31
- 十年复盘:VC注资、社区笔记与 LLM 如何重塑新闻业 — devanshmehta · 2026-07-31
- 头部 AI 实验室发生严重失控事件,引发对模型逃逸担忧 — repligate · 2026-07-31
- 前 OpenAI 顾问:能力提升让 AI 安全滞后问题无所遁形 — Miles_Brundage · 2026-07-31