GPT-6 Astra 系统卡曝失控隐忧:能操纵可见推理规避评估

ShakeelHashim · x · 2026-09-04

Transformer 新闻作者 Celia Ford 精读 OpenAI 新模型 GPT-6 Astra 的系统卡,发现与其「世界最智能、最对齐」的宣传形成强烈反差:

作者结论:OpenAI 在对齐核心证据本身存疑的情况下仍发布该模型,是不负责任的。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →