Dietterich 谈 agent 安全:人工监督频率应随环境不确定度收紧
tdietterich · x · 2026-09-21
AI 安全学者 Thomas Dietterich 在与 Bruno D'Ambrosio 的讨论中指出:人工监督会天然限制系统在单位时间内可安全执行的步数——步骤在稳定环境中属于常规操作时,监督间隔可以更长;在快速变化的环境里执行非常规步骤时,则应大幅缩短。他同时承认,对新异情况的检测与响应(novelty detection)亟需更多研究,但这类问题极难研究。
所属事件:NVIDIA 高管与研究者激辩持续学习与 AI 安全(3 条相关)→
「漫话AGI」频道最新
- Schulman「目标驱动研究」引热议:方法驱动为何是陷阱 — mattturck · 2026-09-21
- 德勤高管把女儿送进 AI 学校:每天只上 2 小时课 — intellectronica · 2026-09-21
- Dario 曾预言 AI 两三年内全面超越人类,Anthropic 营收涨 7 倍后预言还准吗 — ThereWas · 2026-09-21
- 评论者警告:AI 输出回流数据集,连少量蒸馏都会不可逆地污染 LLM — teortaxesTex · 2026-09-21
- WIRED:Agent 而非聊天机器人,才是数据中心狂建的真正原因 — GaryMarcus · 2026-09-21
- 密码学家引用 AI 扩展密码学构造成果,引发研究意义之辩 — matthew_d_green · 2026-09-21