前 OpenAI 安全高管:需要让各类组织都能做自己的后训练
jzl86 · x · 2026-08-17
jzl86 回应一篇关于评测的论文讨论,提出两点判断:
- 真实环境评测(如 @andonlabs 的工作)是近期的积极进展,因为它比传统 benchmark 更难被刷分、更难饱和,缩小了训练环境与部署环境的差距;但由前沿实验室之外的人做的评测数据,目前大概还没有回流到训练中
- 长远需要的是让各种组织都具备做后训练的能力,并靠竞争市场推动频繁更新——不一定需要自建硬件,开放权重有帮助但并非必要条件
「漫话AGI」频道最新
- Grok 引文评 ChatGPT:更广部署引发更多大规模意外风险 — ns123abc · 2026-08-17
- 中国脑读 AI 模型或可提前 4 年预测抑郁症风险 — Affectionate_Bee6434 · 2026-08-17
- AI 若终结编译器,EDA 流程将死:需形式化验证 — satnam6502 · 2026-08-17
- 批 Anthropic CEO 卖多年恐惧后装无辜 — Hesamation · 2026-08-17
- 纽约护士抗议 AI 导致裁员,担忧医疗安全 — KeanuRave100 · 2026-08-17
- Francois Fleuret:生命本质是原子对抗熵增 — francoisfleuret · 2026-08-17