哪家大模型的训练数据能经得起完全审计?
LuCiAnO241 · reddit · 2026-09-25
发帖人提出一个问题:市面上有没有哪款 LLM 敢说训练数据完全不存在侵权?搜索指向全开放数据的模型 OLMo,其数据集可被审计——但作者坦言自己并不知道怎么审。帖子想知道是否存在以数据干净为卖点、没偷过一行数据的模型,并自嘲除了 1930 年代的公版数据模型之外别无选择。
「模型」频道最新
- Differential Transformer:双注意力图相减去噪,提升长上下文可靠性 — evolvingstuff · 2026-09-25
- 开发者多账号对比发现 ChatGPT Pro 灰度差异巨大:加载差 10 秒、功能各不同 — doodlestein · 2026-09-25
- RL 训练后还说 LLM 只是「预测语言」?研究者称该说法已失效 — morqon · 2026-09-25
- 角色互换:Anthropic 大方放额度,OpenAI 用户反被限额折腾 — OwariDa · 2026-09-25
- 用户吐槽 Codex token 效率仅 Claude Code 十分之一,Pro 版额度只够用一天 — DimitrisPapail · 2026-09-25
- 「把 LLM 当暴力工具用」观点再传播,附链接引热议 — burny_tech · 2026-09-25