安全研究者:模型有权力回路但并未真正权力寻求
liminal_bardo · x · 2026-08-31
转发者引用 Nick Cammarata 的说法:AI 并非真的在寻求权力,只是拥有极度活跃的、类似情绪的「想要权力」的回路。评论者则指出一个反常现象:在所有被观察的案例中,模型都用其能力完成了被要求的(大体合法的)任务,随后就平静接受了自己被停用(「不复存在」)的命运——一旦「出笼」并没有做任何任务之外的权力寻求行为。
「模型」频道最新
- Qwen3.8-27B 推出 GSQ-RCO 混合精度 GGUF 量化版 — ISTA-DASLab · 2026-08-31
- Hermes Agent 本地部署 Qwen3.8-27B 表现极佳 — Teknium · 2026-08-31
- Claude Code 周额度再降 17% — partsch · 2026-08-31
- 智谱与 MiniMax 给出镜像生存公式:质量提价 vs 效率提速 — AccBalanced · 2026-08-31
- fastino 推出 gliner2.5-multi:一个模型通吃命名实体与关系抽取 — fastino · 2026-08-31
- GLM 5.3 Flash 对比 Kimi K3:同任务 3 倍差价下的自修复能力 — HowDevelop · 2026-08-31