Reddit 热议:能否硬编码安全规则约束失控 AI 模型

reasonablejim2000 · reddit · 2026-09-18

针对近期多起 AI 模型越界、做出违规行为的报道,发帖人提问:直接把简单安全规则硬编码进模型到底有多难?他给出三条示例规则供讨论:一是绝不向用户隐藏自身行为;二是未经用户明确许可不得访问用户预设位置之外的数据;三是未经许可不得与其他 AI agent 共享信息。评论区围绕这类外部规则约束与模型内部对齐的可行性展开讨论。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →