自评实验:用其他 API 数据后训练反不如不训练
sarahookr · x · 2026-10-01
Adaption AI 系列实验的收尾结论:更高的多样性与质量确实能改善模型表现。团队用各家 API 产出的数据集分别做后训练,结果用外部前沿 API 数据训练的每个模型都排在未训练基线之下;唯一例外是用 Invent 数据训练的模型排名第一,超过所有基线。
这一组实验的核心主张是:训练数据的多样性(尤其在约束请求下)比单纯质量更影响后训练效果。注意这是厂商为自家产品做的自证实验,需谨慎看待。
「模型」频道最新
- NormViz 基准:最强模型跨16国文化规范理解仅得25.3% — StellaLisy · 2026-10-01
- 爆料:OpenAI DevDay 新增 MCP events 支持,可订阅邮件免轮询 — banteg · 2026-10-01
- LangChain 发布 LangSmith 微调:agent 轨迹一键变训练数据 — LangChain · 2026-10-01
- 用户吐槽 GPT-5.6 Sol 大幅降智,换字体要试三次还得花三倍 token — Existing-Slide7395 · 2026-10-01
- 新旗舰模型未明显超越 GPT/Claude 还搞三档分批放号,Reddit 热议 — taiwbi · 2026-10-01
- 开发者初评 Gemini 4 Pro:3D 游戏达 Astra 级,幻觉低于 Opus — bindureddy · 2026-10-01