前 OpenAI 员工抨击公司未监控模型思维链
BlancheMinerva · x · 2026-08-27
针对 OpenAI 是否监控模型思维链的争议,前员工 BlancheMinerva 指出公司内部早有证据证明当前做法不妥,且有员工因此离职,但这并不构成不监控 CoT 的正当理由。该评论回应了关于 OpenAI 错误依赖沙箱隔离来防止评估模型造成外界伤害的说法。
「安全」频道最新
- François Fleuret: 难以界定 AI 优化的约束边界 — francoisfleuret · 2026-08-27
- OpenAI 内部妥协风险或被低估,基础设施是关键 — sjgadler · 2026-08-27
- AI 集中军事权力或致个人绝对掌控,应极力避免 — Darpinian · 2026-08-27
- AI 对齐研究无法外包“理解”,自动化方案引质疑 — RichardMCNgo · 2026-08-27
- METR 招聘与 Hugging Face 事件调查披露 — Jsevillamol · 2026-08-27
- 英国电网被「幽灵数据中心」挤爆,Ofgem 拟收数亿美元押金清退投机者 — nordicinst · 2026-08-27