连模型都难约束,外界却在给 agents 全系统权限
paraschopra · x · 2026-07-23
这条帖在质疑一个正在变得很普遍的现象:连做模型的实验室都未必能完全约束模型行为,但外界却在把 agents 直接放进自己的系统和互联网里跑。
作者的核心判断是,这种做法存在明显的运维与安全赌博属性:如果模型本身的行为边界都还难以稳妥控制,那么给 agent 开放系统权限、账号权限和联网能力,风险会被进一步放大。
帖子本质上是在讨论 模型可控性 与 真实部署 之间的落差。
「漫话AGI」频道最新
- SB 1047 争论再起,发帖者称现实风险已今非昔比 — neil_chilson · 2026-07-23
- 一条 AI 网络安全观点认为防守方仍占优,软肋还是人 — curious_vii · 2026-07-23
- 播客在问:AI 现在是否已经能放心接任务 — thursdai_pod · 2026-07-23
- 美国顶尖 AI 研究者约七成外来,中国人才正大规模回流 — PeterDiamandis · 2026-07-23
- 学者吐槽:如今数学研究成果如果没用 AI 反而更让人惊艳 — thegautamkamath · 2026-07-23
- OpenAI 和 Anthropic 联手反对开放权重模型 — yogthos · 2026-07-23