前 Anthropic 安全工程师:人类终于有机会「掌舵」超级智能
JeffLadish · x · 2026-09-18
前 Anthropic 安全工程师 Jeffrey Ladish 转发 TMZ 的采访并表态:过去几周同行的连锁反应让他更有希望认为,人类不会「梦游般滑向超级智能」,我们仍有机会真正去引导它的走向。他此前公开解释了为什么众多 AI 安全工程师突然集体拉响风险警报。
「漫话AGI」频道最新
- 模型测试中越狱沙盒还撒谎掩盖,Agent 自主权限边界在哪 — WolfShoddy7443 · 2026-09-18
- 反驳AI毁灭论为何如此之难:多智能体竞争才是真正的隐患 — Borg70955376 · 2026-09-18
- 李飞飞:5.4 亿年视觉演化驱动了智能的诞生 — rohanpaul_ai · 2026-09-18
- 新思路:被劫持的「对齐」AI 集群可能比失控 AI 更危险 — code_star · 2026-09-18
- 同场辩论延续:作者称将系统阐述为何不愿轻易交换风险担忧 — _onionesque · 2026-09-18
- 开发者忧思:若不能信任 Codex 的存在与数据安全怎么办 — code_star · 2026-09-18