kalomaze 澄清:AI公司并非直接拿用户记录训练,靠的是诊断
kalomaze · x · 2026-09-09
kalomaze 指出,坊间认为 AI 公司「直接在用户对话记录上训练」的天真想象是错误的,而且这种做法对持续进步反而是反生产力的。真实的改进循环是:从 transcript 中发现人类在做 evals 未覆盖的奇特任务 → 构建覆盖该问题类型的合成数据构造 → 在据此设计的验证集上做 RL。所谓「飞wheel」本质就是诊断学(diagnostics)。
所属事件:Navier-Stokes 证明陷数据泄露争议,OpenAI 多方回应(67 条相关)→
「模型」频道最新
- OpenAI 宣布解决 Navier-Stokes 千禧年难题 — Swarooprm7 · 2026-09-09
- 5 天训练 4 天解题?网友吐槽大厂模型发布周期拖沓 — Darpinian · 2026-09-09
- OpenAI 宣称用智能体集群求解 90 年悬而未决的纳维-斯托克斯难题 — soumitrashukla9 · 2026-09-09
- 传 Anthropic 将连续 10 天每日重置用量上限 — eigenron · 2026-09-09
- 若有人对 Codex 敲下「continue」解出千禧年大奖难题,OpenAI 广告效果拉满 — eigenron · 2026-09-09
- Astra 表现一夜突变,用户吐槽「流沙式换模型」体验糟糕 — natesiggard · 2026-09-09