前 OpenAI 研究员:狂吞全网数据是前沿模型的致命伤
sull · x · 2026-09-13
作者批评前沿模型(frontier lab models)的训练策略存在致命缺陷:急于把「人类倾倒的全部网络噪音」囫囵吞下作为训练数据。这延续了他一贯对预训练数据质量与 scaling 策略的质疑,认为不加筛选地吞下海量网络内容注定出问题。
「模型」频道最新
- M5 Pro 64GB 本地跑 Qwen 实测:仅约 20 tok/s,长上下文更慢 — rJohn420 · 2026-09-13
- 开源模型真有人天天用吗?一条质疑开源热潮的争议帖 — flowersslop · 2026-09-13
- 全双工语音模型仍难拟人:轮次切换预测器召回差、误判多 — alexisgallagher · 2026-09-13
- yoavgo 质疑:机器人新模型并非零样本,而是对每个任务训练到极致 — benno_krojer · 2026-09-13
- NVIDIA 称小模型 Nemotron-3-5 Lightning 大幅反超自家 Ultra 大模型 — eliano · 2026-09-13
- 若开放模型遭禁,评论者:别忘了还有 BitTorrent — StefanoGogioso · 2026-09-13