AI 安全研究员自述 2022 年「恐惧时刻」:GPT-4 已训完、导师离职
JacquesThibs · x · 2026-09-14
AI 安全研究员 JacquesThibs 回忆自己在 2022 年 8 月产生的 AI 风险「恐惧时刻」:他连续数天在白板上推演对齐问题的解法,推演树总是指向欺骗与 Goodhart 效应搞砸一切;他的导师在 GPT-4 刚完成训练后因时间线骤然缩短而恐慌离职,认为从内部已无力回天;另一位前导师也因知晓 GPT-4 训练完成和下一次能力跃升,确信强 AI 时间线将提前到 2026 年。帖子揭示了 GPT-4 早在公开发布前数月就已完成训练,以及其内部冲击如何改变了安全研究员的判断。
「漫话AGI」频道最新
- Nina Schick:公众既不信任 AI 实验室也不信任监管者,没人能「降速」AI — NinaDSchick · 2026-09-14
- 黄仁勋:未来二十年的科技进展将超过去总和 — rohanpaul_ai · 2026-09-14
- 研究员 Houda:模型越强我越不担心了,p(doom) 该退休了 — soumitrashukla9 · 2026-09-14
- 安全老手批 AI 实验室:能力≠风险,网安评估缺威胁建模 — HackingLZ · 2026-09-14
- 研究者疑猜:GPT-4o 精神病案例文风神似 SCP 维基训练数据 — code_star · 2026-09-14
- Vals AI 创始人:前沿实验室不该自己给前沿打分 — JenniferHli · 2026-09-14