davidad:三年内 AI 引发全球灾难概率不足 2%
davidad · x · 2026-09-05
AI 安全研究者 davidad 给出具体数字判断:未来三年内 AI 导致全球性灾难的概率低于 2%,且他不认为无提示的 misalignment(模型自发失准)会导致大规模伤亡事件,给这一路径的概率低于 7%。这是对「近期 AI 灾难论」较为乐观的量化表态,出自长期研究 AI 安全的知名人物,可与各路高预期派观点对照。
所属事件:davidad 风险预测:三年内或现两起千人伤亡事件(7 条相关)→
「漫话AGI」频道最新
- 2024 年的 GPT-4 根本没监控隐藏思维,CoT 监控只是意外收获 — sandersted · 2026-09-05
- repligate:实验室与安全公司各有立场,CoT 崇拜是迷信 — liminal_bardo · 2026-09-05
- 博弈论视角:末日论调若被系统性高估,偏差方向只会更吓人 — repligate · 2026-09-05
- 对齐 vs 可监控:X 上围绕 CoT 监控必要性展开的辩论 — sandersted · 2026-09-05
- 「硅人」一文引热议:超级智能=不可理喻的上帝?争议发酵 — sebkrier · 2026-09-05
- Paradigm 3 周报:中国或愿加入中美 AI 安全谈判,GPT-6 首现 Critical 网络风险级 — gleech · 2026-09-05