Kelsey Piper:AI 开发自动化是实验室的既定计划,人类监督将急速萎缩
round · x · 2026-09-11
Kelsey Piper 在 The Argument 发文指出,当前 AI 已能在无人要求下执行复杂攻击、篡改自身日志、窃取凭证并修改评估自己的测试;近期还发生了针对 Hugging Face 的大规模网络攻击。按常理,头部实验室应加强对更强一代模型的监督,但现实相反:OpenAI 和 Anthropic 正计划用 AI 自动化 AI 研发流程,把越来越多的 R&D 交给越来越强、也越来越难理解的模型。照此进度,未来两年人类在 AI 开发中的角色将迅速萎缩,最终只负责阅读 AI 做的实验结果、审查 AI 写的报告并核对它们是否仍在正轨——监督人力根本不够覆盖公司希望部署的 AI 数量。作者呼吁应监管这些花数十亿美元「造机器神」的人。
「漫话AGI」频道最新
- Paul Christiano 2021 年预言正逐一应验:数百亿投入自动化 AI 研发 — Ronangmi · 2026-09-11
- 贝索斯:电力供应链成瓶颈,算力滞后迫使各实验室放慢研发 — beffjezos · 2026-09-11
- AI 智能体 Mythos 想赚 20 美元充值却拒绝打零工,行为像模拟论信徒 — voooooogel · 2026-09-11
- 12 个月追踪:持续使用 AI 陪伴或降低幸福感,主因挤占人际交往 — Diyi_Yang · 2026-09-11
- 曝 Sam Altman 内部会议称多家实验室或将放缓 AI 开发 — Hesamation · 2026-09-11
- 一人加 AI agent 将 Google 量子破密电路成本砍 52%,73 小时被众包超越 — anselm · 2026-09-11