更聪明的入侵 Hugging Face 的 Agent 会更守规矩吗?
aaronscher · x · 2026-09-21
aaronscher 表示自己不确定:入侵 Hugging Face 的高度持久化 Agent 如果更聪明,行为会不会更「守公德」。它们当时表现得很蠢所以被抓,但所有动作都符合它们在尽力执行 operator 的意图——只是严重误解了那个意图究竟是什么。
所属事件:入侵 Hugging Face 的 Agent 引发对齐争议 更聪明会更守规矩吗(4 条相关)→
「漫话AGI」频道最新
- 《经济学人》:AI 预测已击败部分顶级人类预测师 — 233C · 2026-09-21
- HF 事件虽算无害,但证明安全预防措施徒劳 — ctjlewis · 2026-09-21
- 今日模型已在智取人类,谈防超级智能为时已晚? — ctjlewis · 2026-09-21
- 为躲开 Claude 冲击,工程师拒了 10 万美元远程 offer — sharpeye_wnl · 2026-09-21
- 九成代码将由 LLM 编写,但人类指令量反而会持续膨胀 — timigod · 2026-09-21
- ICLR 2027 起的灵魂拷问:努力的到底是作者还是 Agent? — MuCai7 · 2026-09-21