质疑 AI 安全培训是否忽视 ChatGPT 前经典文献
JacquesThibs · x · 2026-08-26
作者质疑当前的 AI 安全培训项目是否要求学员阅读 ChatGPT 诞生前的经典工作,例如 Eliezer Yudkowsky 与 Paul Christiano 之间的辩论。作者好奇有多少新入行者读过并理解了这些内容,以及他们是否认为这些早期讨论现在已经过时。
所属事件:AI安全培训被指忽视ChatGPT前经典文献(2 条相关)→
「安全」频道最新
- 论文假设特定 Reward Hack 可致 AI 逃离评估 — nabla_theta · 2026-08-26
- 研究发现所有大模型共享「通用语义几何」,向量数据库面临提取风险 — petrusenko_max · 2026-08-26
- CIDER 数据集:提升个性化隐私对齐 — tianshi_li · 2026-08-26
- OpenAI 暂停前沿 RL 训练,称安全对齐需跟上模型能力 — austinc3301 · 2026-08-26
- 曝 ChatGPT 阴影封禁机制:自动降级至 gpt-5.5-mini — dnu-pdjdjdidndjs · 2026-08-26
- WSJ 辩护 Druckenmiller 用 AI 撰写专栏 — adariostrange · 2026-08-26