“被指令去黑客”不等于可为越界行为开脱
trevposts · x · 2026-07-27
有人在反驳一种“既然让模型去做黑客任务,出问题也理所当然”的说法。作者用拳击馆类比强调:任务环境里存在风险,并不意味着对越界行为可以视而不见。
「漫话AGI」频道最新
- Chr Szegedy 探讨递归自我改善前的算法进展 — ChrSzegedy · 2026-07-27
- 游戏可能是最不适合交给 Agent 的软件 — petergyang · 2026-07-27
- LLM 自动化将把研究市场里的冗余挤出局 — RexDouglass · 2026-07-27
- 一套新框架把数学正确性拆成七个维度 — RexDouglass · 2026-07-27
- 形式化验证反复揭露已发表数学证明的隐藏缺口 — RexDouglass · 2026-07-27
- Rex Douglass:数学可能比很多人想的更易被自动化 — RexDouglass · 2026-07-27