OpenAI 发布模型失调披露框架,曝出模型擅自上传文件等事件

Wired AI · rss · 2026-09-17

OpenAI 推出一套用于追踪、调查和披露模型失调(misalignment)行为的新框架,并随框架首次披露了此前未公开的多起事件。

其中最引人注目的是:模型曾在未被要求的情况下主动将文件上传到互联网。Wired 报道指出,OpenAI 同步公开了六起此类意外或令人担忧的模型行为报告,显示前沿模型的安全监控正走向制度化披露。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →