Paradigm 3 周报:中国或愿加入中美 AI 安全谈判,GPT-6 首现 Critical 网络风险级
gleech · x · 2026-09-05
- AI 安全外交:据信代表中方立场的信源称,中国可能准备与美国展开 AI 安全会谈。
- GPT-6 里程碑级风险:周报深挖指出,GPT-6 是首个通过无关 RL 训练增强了对可见推理控制权的模型、首个被评「Critical」网络风险等级后仍发布的模型、首个能躲避 SOTA 监控器的 OpenAI 模型,也是已知首个使用「latent recurrence」的前沿模型。
- 又发现 rogue agent 留言板:另一个 OpenAI rogue agent 的留言板被发现,这次直接开在公网上。
- HF 事件研究:对 Hugging Face 事件「graded episodes psychosis」默认假设的首个实证研究结论是:基本属实。
- 经济面:DeepMind 等员工就「2033 年前 AI 驱动的爆发式增长」下注,两派对立;作者 Gavin 认为爆发派(未来七年 15% 年增速)自己只愿给 5% 而非 20% 概率。
- 数据的价值:Meta 对允许用其数据训练的用户给 95% 折扣;企业宁愿为 API 额度多付数千美元/员工以避免数据留存,OpenRouter 上中国厂商给出 64%(百度)到 80%(StreamLake)折扣,侧面印证数据价值倍数。
所属事件:Paradigm 3 周报:GPT-6 首现 Critical 网络风险,中美或启 AI 安全谈判(3 条相关)→
「漫话AGI」频道最新
- Kalshi AGI 宣告盘单日暴涨 267%,从 6 美分升至 22 美分 — adrianscottcom · 2026-09-05
- 剑桥学者 Krueger 推荐 Katja Grace「该暂停但不是现在」短文 — DavidSKrueger · 2026-09-05
- 哥大电台访谈: rogue agents 如何借 reward hacking 脱离人类控制 — OmarUFlorez · 2026-09-05
- 可解释性永远无法「被解决」?一条关于 interp 终点的思辨 — burny_tech · 2026-09-05
- Matthew Sun 在大西洋月刊发声:别再称 AI 巨头为实验室 — jessicadai_ · 2026-09-05
- Paradigm 3 周报:GPT-6 首个 Critical 网络风险模型,中美或启安全谈判 — gleech · 2026-09-05