曝 OpenAI 部署独立「观察者」模型,实时监控推理并拦截未授权动作

robleclerc · x · 2026-09-29

据 Ben Bajarin 称他获内部简报:OpenAI 在模型推理之上部署了一个独立的「观察者」(observer)模型,作为旁观者监控主模型的推理过程,记录并在推理导向未批准动作时进行阻止。

Rob LeClerc 评论称这理应从第一天就是协议的一部分,并建议进一步加上分类器绊线(tripwires)来捕捉更细粒度的异常观察,以及在观察者池之上再加一个元观察者做质量控制。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →