OpenAI 发布模型失准披露框架并公开六份案例报告

OpenAI 官方发布了一套用于追踪、调查和公开披露模型失准(misalignment)行为的新框架,并同时公布六份报告,涵盖过去六个月在训练或评估中观察到的失准实例。这是头部实验室首次系统性建立此类披露机制,其对行业透明度标准的示范作用值得关注。

已确认

为什么重要

2026-09-17 ~ 2026-09-18 · 7 条相关

一手来源

另有 1 条近重复转述:PrajwalTomar_