安全研究者激辩:冷血反社会 ASI 算法终将被人跑起来
davidmanheim · x · 2026-10-02
一场关于 ASI 价值对齐的争论。@steve47285 认为,造一个「冷血反社会 ASI」显然是坏的,但反社会人类的存在本身证明这类算法可行——只要有人愿意跑,它就可能发生,这与长期主义无关。AI 安全研究者 davidmanheim 以 Anakin 梗图回应,暗示自己在这场辩论中立场被推向了对立面。
「漫话AGI」频道最新
- 剑桥学者 Krueger 发问:现有 AI 有无真正长期偏好 — DavidSKrueger · 2026-10-02
- 前OpenAI对齐研究员Buck谈AI实验室内部安全资源层级 — anpaure · 2026-10-02
- Andy Matuschak:软件价格趋零,人人学编程的老梦想还成立吗 — andy_matuschak · 2026-10-02
- repligate 炮轰安全派写作:他们真相信自己说的话吗 — repligate · 2026-10-02
- 开发者:App Store 工具类应用已成「按需生成」的坟墓 — signulll · 2026-10-02
- 善待 AI 吗:学者称对智能体施暴会腐蚀人类自身 — MatthewBerman · 2026-10-02