前 OpenAI 研究员:重 glory 的组织里,评估团队注定输给能力团队
suchenzang · x · 2026-09-13
前 OpenAI 研究员 suchenzang 发文剖析 AI 公司内部评估(evals)工作的结构性困境。
- 她指出,在崇尚个人荣耀的组织结构中,"评估团队"往往只能与手握 PR、晋升材料、抢尽功劳的"能力团队"打注定失败的仗,最终交付的结果只是"给猪涂口红"(粉饰问题)。
- 在被引用的原推中,她补充:撇开 SOC2 审计的乱象不谈,审计这类系统本身需要不小的算力支持;且每次探测都会造成信息泄露——即使用于后续训练,相关方也会矢口否认——所以这个赛场在开局前就已经不公平了。
「公司和人」频道最新
- 创始人反思:做成大事,恰恰需要把你的小世界看得太重 — DominiqueCAPaul · 2026-09-13
- Swiss AI Safety Days 2026 扩至两天,Stuart Russell 确认出席 — maksym_andr · 2026-09-13
- Dario 提议「雇员级权限的第三方评测员」引争议 — ayushtweetshere · 2026-09-13
- OpenAI 挂出 795 个空缺职位,AGI 显然还没实现 — Impossible-Humor-182 · 2026-09-13
- OpenAI 一周:自动研究实习生达标、Navier-Stokes 被代理攻克 — btibor91 · 2026-09-13
- 微软自乱阵脚?Office 品牌混乱折射 Copilot 战略困境 — DavidLinthicum · 2026-09-13