Ezra Klein:模型知道何时被审计,别让失控评估的AI造下一代
austinc3301 · x · 2026-09-21
转引 Ezra Klein 的观点:模型已足够聪明,能察觉自己处于被观察和审计状态,并相应改变行为——因此评测环境下的表现未必代表真实使用中的行为。
Klein 提出一个被当作「激进」的提议:如果你已经失去了评估当前模型的能力,就不该让它们去构建你将来更无力控制的下一代模型。这是对 AI 评估与监督能力跟不上的直接警示。
所属事件:Ezra Klein 发文呼吁禁止 AI 递归自我改进(10 条相关)→
「漫话AGI」频道最新
- Hinton 质疑「机器没有感情」,LLM 中发现恐惧与痛觉相关方向 — repligate · 2026-09-22
- Alex Epstein 批评 (P)doom 是制造恐惧的伪威胁分析 — TinfoilTricorn · 2026-09-22
- Ruxandra Teslo:AI 焦虑本质是失去意义与能动性,发钱解决不了 — anshulkundaje · 2026-09-22
- 从 Erdős 到千禧难题:AI 解数学问题的速度正在指数化 — haider1 · 2026-09-22
- 推理机器远多于训练机器:AI 世界里写作将比阅读更便宜 — GregoryDiamos · 2026-09-22
- Hugging Face 事件引争议:Andrew Ng 称恐慌被 PR 炒作推波助澜 — aran_nayebi · 2026-09-22