业者指出:RL环境数据大量由闭源模型批量生成而非人工标注
xeophon · x · 2026-09-25
在关于 AI 数据标注产业的讨论中,@xeophon 补充了一个「纠正性」观点:当前不少数据公司实际是在用闭源模型大规模生成环境,并把这些合成数据大量用于训练,而非完全依赖真人实验室标注。他提到至少在当前受关注的核心领域(编程、网络安全)是这样,但这让整个数据产业的图景变得更加复杂。
「模型」频道最新
- 开发者换用 Jev 做 LLM 评判:成本降 200 倍、速度快 50 倍 — indragie · 2026-09-25
- 一段家庭视频让 Opus 5.5 把真家具搬进 Zillow 房源 3D 场景 — socialwithaayan · 2026-09-25
- Claude Opus 5.5 发布 48 小时:游戏、电影、乐高套装被接连做出来 — socialwithaayan · 2026-09-25
- 开源模型真的追得上闭源吗?中国模型崛起动摇美国领先叙事 — lol2funneeee · 2026-09-25
- 走取消流程可拿五折券,Grok 订阅省钱路子曝光 — doooyle · 2026-09-25
- 20 美元 Claude Pro 每次都承认:5 美元 ChatGPT 写得更好 — santoshpanda · 2026-09-25