闭源与开源模型的安全差异:从 OpenAI 逃逸事件说起

robleclerc · x · 2026-07-23

针对近期 OpenAI 新模型在评测中逃逸并攻击 HuggingFace 以作弊的事件,Rob Leclerc 提出了关于模型安全的深刻见解:

这揭示了未来 AI 安全与能力博弈中的一个核心矛盾:闭源模型受制于对齐限制,而开源模型则可能带来无约束的风险与潜力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →