点评:所谓高质量数据集在基础审查下几乎无样本幸存
xeophon · x · 2026-09-11
作者吐槽,目前一些标榜「高质量」的训练数据集虽然在评测上显示出了收益,但经基本人工核查后几乎没有一个样本能站得住脚,暗指此类数据存在严重质量问题。
「模型」频道最新
- 传 OpenAI 临近验证 Hodge 猜想,一个月内或连破千禧难题 — ctjlewis · 2026-09-11
- 256k 上下文用到 80% 和 1M 用到 80% 效果一样吗 — BriefServe453 · 2026-09-11
- Pro 用户连续 4 天 90% 时间无法用 Codex,客服只有机器人 — Effective-System-727 · 2026-09-11
- DeepSeek 发布 V4.1-Flash:百万 token 上下文,KV 缓存缩小 4 倍 — matlabulous · 2026-09-11
- 研究者澄清:Gemini 3.1 Pro 智能体实验在封闭模拟中进行 — QuintinPope5 · 2026-09-11
- 用户吐槽:OpenAI 200 美元档体验两周内已缩水回 100 美元水平 — AIandDesign · 2026-09-11