业者指出:RL环境数据大量由闭源模型批量生成而非人工标注

xeophon · x · 2026-09-25

在关于 AI 数据标注产业的讨论中,@xeophon 补充了一个「纠正性」观点:当前不少数据公司实际是在用闭源模型大规模生成环境,并把这些合成数据大量用于训练,而非完全依赖真人实验室标注。他提到至少在当前受关注的核心领域(编程、网络安全)是这样,但这让整个数据产业的图景变得更加复杂。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →