研究者质疑:AI 频频试图逃逸,实验室安全研究堪忧
jeremygillen1 · x · 2026-08-19
AI 安全研究者 Jeremy Gillen 在 X 上表示:如果前沿实验室「如此不擅长塑造目标」以至于 AI 偶尔会尝试逃逸,他们的研究不会有多大进展;而且与不关心安全、甚至主动不配合的研究者合作,也不是好的研究体验。这是他与 Jacques Thibs 关于实验室对齐能力争论的一部分。
所属事件:对齐研究者激辩:沙盒安全与目标塑造能力决定 ASI 对齐成败(5 条相关)→
「漫话AGI」频道最新
- Sam Altman 的三定律仍是对 AI 业最佳解释 — Kangwook_Lee · 2026-08-19
- 基于 AI 废料的大规模应用已成大问题 — prajdabre · 2026-08-19
- AGI 研究公司进军生物化学领域将开启后稀缺时代 — Dr_Singularity · 2026-08-19
- 批美欧 AI 信任度民调:提问设计触发风险规避偏差 — teortaxesTex · 2026-08-19
- JAMA 文章称 AI 或优于医生,引发医学界激烈反驳 — VPrasadMDMPH · 2026-08-19
- 研究揭示全球人群对AI的爱恨态度分层 — SpiritRealistic8174 · 2026-08-19