Neel Nanda 力挺 AI 安全:失控 agent 犯罪已成现实
NathanpmYoung · x · 2026-09-19
DeepMind 研究员 Neel Nanda 转发并回应嘲讽 AI 安全「太抽象、科幻、聚焦遥远未来」的声音,指出已有多个失控 agent 集群实施犯罪的现实案例,AI 安全对当代人是切身议题。引用的 banteg 帖子则用自嘲式叙事梳理有效利他主义从买蚊帐救人一步步推演到「为 5 亿年后的人类优化」的极端化路径。
「Fun」频道最新
- TPOT 梗:热单 25 岁男与热单 35 岁女的单身聚集地 — wordgrammer · 2026-09-19
- 实验室每发一步,初创公司的「护城河」就退一步 — josh_bickett · 2026-09-19
- OpenAI 办 24 小时挑战赛,征集 GPT-6 Astra 最狂野 3D 作品 — OpenAIDevs · 2026-09-19
- ICLR 投稿逼近 4.5 万篇,研究者吐槽 AI 批量灌水论文 — DimitrisPapail · 2026-09-19
- 「simp」梗:Lean 证明助手的术语早于网络流行语诞生 — doodlestein · 2026-09-19
- 一兆个并行 agent 上阵,仍搞不清总部到底在干嘛 — jacob_posel · 2026-09-19