研究显示顶尖 AI 实验室缺乏叛变模型遏制计划
emmanuelvivier · x · 2026-08-23
Guidelight AI Standards 的一项研究显示,包括 OpenAI、Anthropic 和 Meta 在内的五大顶尖 AI 实验室,大多缺乏公开的详细计划来应对试图颠覆人类控制的“叛变”模型。OpenAI 在此次评估中得分最高,而 Anthropic 和 Meta 得分最低。
「漫话AGI」频道最新
- 从写代码到端到端制造:这才是 Agent 的真实故事 — ProfBuehlerMIT · 2026-08-23
- 怀念 GPT-4.5 级情感智能,期待 Astra 复刻 — haider1 · 2026-08-23
- AI 从推理物理世界到直接操作机器的边界正在模糊 — ProfBuehlerMIT · 2026-08-23
- 支持开源人形机器人或成影响人类未来的关键变量 — verdakorz · 2026-08-23
- 青少年把「如何说话」外包给AI,失去的正是自我探索 — APPSO · 2026-08-23
- 研究称 AI 可能导致科研质量下降而非提升 — The Decoder · 2026-08-23