延续讨论:未经明确约束就会犯重罪的模型本身就是问题

lxrjl · x · 2026-09-03

同一线程中作者的自我补充与反驳。

这条补充把争论从「评测规范是否写清」提升到「模型默认行为边界」的层面。

所属事件:安全研究者:模型不应依赖用户明令才守法(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →