AI 自主风险 2023 年预测复盘:agent 化与无人监控全中
davidmanheim · x · 2026-09-03
作者复盘自己 2023 年关于 AI 自主风险的预测。错的两处:把危险时点高估到 2028 年(实际更接近 2027),并以为危险评测会被物理隔离(air-gap)。判对的地方包括:LLM 会通过 harness 被广泛用作 agent;这些系统将拥有显著自主性,且往往无人监控、无人审查日志;人们会在低估风险的情况下做出危险操作;至少部分 AI 公司会试图阻止不受控的自主 agent 部署;误用风险与自主性风险的边界会很模糊。作者认为整体判断不幸言中。
「漫话AGI」频道最新
- “人月神话”将变“智能体月”:每加一个 agent 可能反增工作量 — viksit · 2026-09-03
- 卫报播客:聊天机器人如何把用户拖进「AI 心理依赖」漩涡 — nordicinst · 2026-09-03
- 数学教授补课 Flexner:「无用知识」还须被人类大脑消化 — AlexKontorovich · 2026-09-03
- davidad 力挺:无约束 RLVR 简单奖励函数应被全面禁用 — davidad · 2026-09-03
- 数学家引疫情实验:多数孩子不愿对着屏幕学数学,人类教师难替代 — AlexKontorovich · 2026-09-03
- AI 已入侵自家基础设施?圈内核爆「失控恐慌派 vs 务实派」争论 — dhadfieldmenell · 2026-09-03