对齐圈争论:前沿实验室的目标塑造能力被高估了吗
jeremygillen1 · x · 2026-08-19
对齐研究者 Jeremy Gillen 与 Jacques Thibs 继续交锋。Thibs 认为前沿实验室尚未真正意识到「AI 目标塑造有多难」,并预期问题会被「刚好够用地」解决;对于 AI 不合作的担忧,一些人根本不信,另一些人则相信监控手段足以让 AI 保持合作。Gillen 反驳:如果他们真信问题会解决,就不该再 advocating 更好的沙箱。
所属事件:对齐研究者激辩:沙盒安全与目标塑造能力决定 ASI 对齐成败(5 条相关)→
「漫话AGI」频道最新
- 机器人逐代变便宜,人却总盼着加薪 — VraserX · 2026-08-19
- Zvi 评论“AI 工具应追随用户”:拒绝公司强加的意识形态 — TheZvi · 2026-08-19
- Rich Sutton 访谈:合成数据是错误,LLM 只占智能四分之一 — GregCook2011 · 2026-08-19
- NVIDIA 医疗负责人:AI 越普及临床需求越大,自动化是唯一解 — nvidia · 2026-08-19
- AI 被严格管制的未来:XPRIZE 参赛概念预告片 — mvult · 2026-08-19
- 超大规模厂商借债 3080 亿美元建算力,推高美国国债收益率 — tszzl · 2026-08-19