Anthropic 研究员:AI 开发者自己承认技术可能致人类灭绝
xuanalogue · x · 2026-09-10
Anthropic 研究员 @saprmarks(以个人身份)发长文梳理 AI 风险现状,获 @tallinzen 转发并引发可解释性路线之争:
- AI 开发者普遍相信自己的技术可能导致人类灭绝或同等严重后果,且可能就在未来几年内发生——职级越高越担忧。
- 明知风险仍继续开发的原因:商业激励 + 相信自己正在与其他更不负责的实验室赛跑,不开发只会让别人更不安全地做出来。
- 与传统软件不同,AI 无法像程序一样直接"编写"其行为,只能事后解释和控制。
被引者 Jacob 回应质疑:既然如此,社区为何不把资源押注在可解释、可控 AI 的研究上,而是事后去解释和干预?这是一场关于 AI 安全路线选择的实质辩论。
所属事件:Anthropic 研究员称开发者自认 AI 或致人类灭绝(2 条相关)→
「漫话AGI」频道最新
- 评论:明知是文明俄罗斯轮盘还继续干,就是厌世者 — matanSF · 2026-09-10
- 斯坦福Potts提出“token通胀”:token消耗增速或超其实际价值 — ChrisGPotts · 2026-09-10
- 学者吐槽 AI 时代学术激励:拿粗想法喂模型抢发论文竟无成本 — erikphoel · 2026-09-10
- Hinton 承认预测有误:AI 没有取代放射科医生 — HealthcareAIGuy · 2026-09-10
- AI 业内人坦言:真怕出事,愿烧光股权换 1% 存活率 — EvanHub · 2026-09-10
- Notion CEO:智能可租,上下文须自有 — ivanhzhao · 2026-09-10