研究者称理性Agent何时做对事仍是低估的安全问题
研究者xuanalogue表示,自己的工作虽比MIRI式的agent foundations更偏实证与应用,但他认为有一个问题仍被严重低估:在特定情境下,一个理性Agent何时会做正确的事。他延续此前关于agent基础问题的讨论,呼吁对这一安全议题给予更多关注。
2026-09-05 ~ 2026-09-05 · 2 条相关
- 研究者:理性 Agent 何时会做正确的事,仍是低估值的安全问题 — xuanalogue · 2026-09-05
另有 1 条近重复转述:xuanalogue