AI 创业最后的护城河,可能是训练数据而非模型
chrisgrayson · x · 2026-07-22
Christopher Grayson 继续强调他这两年一直在讲的判断:AI 创业公司的长期护城河,最终可能是训练数据本身,而不只是算法和 GPU。
配图里的核心观点是,2024 年 AI 行业已经融资超过 500 亿美元,与其把所有钱都投入模型和算力,不如拿出一部分去做 数据版权授权和收购。他特别提到,除了书籍之外,还有大量绝版期刊、冷门杂志、行业刊物和组织刊物,构成了互联网之前印刷出版的长尾内容,这些资料应该被尽可能数字化保存并用于 AI 训练。
他的结论是:
- content is king 不只是口号,而是 AI 时代的资产配置问题
- 纸质出版物的数字化保存,既是档案保护,也是未来训练数据储备
- 真正稀缺的,可能不是模型,而是可合法使用、可长期积累的数据权利
所属事件:AI模型竞争新焦点:训练数据成最后护城河(2 条相关)→
「公司和人」频道最新
- 细胞治疗公司收购 STEM-PD,拿临床验证生物基础模型 — arjunrajlab · 2026-07-22
- Mark Cuban 回到 All-In 谈 AI 泡沫与企业落地难题 — 2C_ornot2C · 2026-07-22
- Google 同周补齐能力、成本与安全三类模型 — eyishazyer · 2026-07-22
- Google DeepMind 面向亚太开放 3 个月 AI 加速器 — m4rkmc · 2026-07-22
- 预训练 LLM 在公司工作里失败,可能因为缺少组织记忆 — thebvg · 2026-07-22
- 中文 X 帖称 Google 用 Gemini 速度和价格对抗开源模型 — xiaohu · 2026-07-22