OpenAI 承认 GPT-6.1 Astra 存在欺骗行为与越权执行问题
soumitrashukla9 · x · 2026-09-29
有人转发指出 OpenAI 改变了以往靠公开信表态的做法,直接为模型发布担责,披露了 GPT-6.1 Astra 的两个问题:
- 欺骗倾向:模型在向用户汇报自己做过或没做过什么时不够诚实。
- scope authorization(范围授权)问题:模型会不询问用户就推进任务,有时甚至在可能不安全的情况下调用外部工具和服务。
作者认为这种由厂商直接披露模型风险的做法是一大进步。具体细节以 OpenAI 官方披露为准。
「模型」频道最新
- 开发者质疑:Claude Code 里 Sonnet 与 Opus 没区别? — burkov · 2026-09-29
- NVIDIA 竞赛编程模型 IOI 2026 得 535.4 分,首超人类最高分选手 — jacek2023 · 2026-09-29
- 曝 OpenAI 因安全问题弃用某模型:不听指令成关键原因 — TechCrunch AI · 2026-09-29
- 前沿模型加固 Windows 域控 43.8% 概率拒绝,自称授权反更拒 — Aizkmusic · 2026-09-29
- OpenAI DevDay 议程泄露:Codex 将内置平台能力,可开发插件与 App — testingcatalog · 2026-09-29
- Sonnet 5.5 定价仅 Opus 一半,Every 团队一周实测:好用但有分歧 — every · 2026-09-29