AI 安全圈争论:训练方式本身是否意味着模型会危害人类
davidmanheim · x · 2026-09-09
一场关于 AI 存在性风险的简短交锋。sebkrier 质疑「模型按某种方式训练并不必然推出它会危害所有人」;davidmanheim 部分认同,但强调这等同于一个不同的论证——不能把模型的风险简单类比成「问一个同样聪明的普通人会怎么做」,因为模型的训练方式与人类认知来源根本不同。
所属事件:AI安全圈激辩:梯度下降训练能否对齐人类价值观(3 条相关)→
「漫话AGI」频道最新
- Toby Ord 重申预训练 scaling 正在放缓且空间不大 — tobyordoxford · 2026-09-09
- Katja Grace 长文:为什么「减缓 AI 进展」不该被双标冷落 — zetalyrae · 2026-09-09
- ACL 审稿人称 4 篇送审论文 3 篇是 AI slop,无人指出 — artetxem · 2026-09-09
- EPFL 实验室宣布全面转向 AI 对齐与安全研究 — maksym_andr · 2026-09-09
- 数学家 Bessis:AI 正在瓦解「定理经济」,数学界尚未准备好 — stevenstrogatz · 2026-09-09
- 从业者观点:护城河不只是模型,编排、工具链与算力缺一不可 — tekbog · 2026-09-09