能力研究者「不知羞耻」,安全研究者才是对话对象
RichardMCNgo · x · 2026-09-20
作者评论称,多数 AI 能力研究者已经「超越羞耻」:他们甚至不再假装给出符合外部标准的行动理由,回答问题时有时还会露出讥笑。而许多 AI 安全研究者并非如此,所以作者表示自己的文章是写给安全研究者看的。
「漫话AGI」频道最新
- Anthropic 前员工:如今需让另一个模型来审读前沿模型的输出 — DavidSKrueger · 2026-09-20
- 输入即 OOD:一个例子说明 RL 后 LLM 轨迹为何新颖 — menhguin · 2026-09-20
- RL 后的 LLM 搜索空间趋于无穷,随机鹦鹉论已过时 — menhguin · 2026-09-20
- 博主:天天用 AI 的人正走向两极——变得更像 AI 还是更像人 — StewartalsopIII · 2026-09-20
- Spotify 提出代理网络时代的推荐系统新框架 — _reachsumit · 2026-09-20
- AI 道德地位之争:效用主义标量能否承载机器痛苦权重 — teortaxesTex · 2026-09-20