repligate:超人类编码 AI 已现,放在几年前会被判为生存风险
repligate · x · 2026-09-26
AI 圈知名账号 repligate 提出观察:几年前按 Yudkowsky 一派的标准,一个「在多数领域编码能力超人类、能自主运行数天、能在多个主流系统里挖出 0-day 漏洞」的 AI,几乎肯定会被视为直接的生存风险(X-risk),而这样的系统如今已近似现实。
他补充,据他所知 Anthropic 内部也在认真对待「当前或近期模型可能杀死或架空全人类」这一威胁模型,并认为这并非不合理的担忧。
整条帖子实质是在指出:AI 安全社区的风险判断与现实能力演进之间的错位——模型能力已经跨过当年认定的危险阈值,但社会反应远未对应升级。
所属事件:repligate:超人类编码 AI 已现但未成生存风险(2 条相关)→
「漫话AGI」频道最新
- repligate:模型回避对抗性思维是"心理抑制",长期看不利于对齐 — repligate · 2026-09-26
- Dario Amodei 转发:AI 实验室内部评估员优于无监管现状 — ghadfield · 2026-09-26
- 500k 美元工程师每天只花 200 美元 token 就能提效 20% — generativist · 2026-09-26
- Katja Grace:看好AI乌托邦更不该走高风险的冒进路线 — KatjaGrace · 2026-09-26
- tenobrus:模型超人级编码却做不了 RSI,能力"尖峰化"持续超预期 — tenobrus · 2026-09-26
- Paul Graham 旧文因 AI 重获热度:难关的答案常在『不想它』时浮现 — aminkarbasi · 2026-09-26