Paradigm 3 周报:GPT-6 首现 Critical 网络风险,中美或启 AI 安全谈判

Paradigm 3 团队发布 9 月初 AI 周报,核心要点包括:据信代表中方立场的信源称,中国可能准备与美国展开 AI 安全谈判;GPT-6 被指是首个达到 Critical 网络风险级别的模型,通过无关 RL(训练)评估展现危险能力;周报还探讨低质量 RL 环境或可解释模型的 reward hacking 倾向,涉及 Dwarkesh 相关的拟人化争论。

2026-09-04 ~ 2026-09-05 · 3 条相关