GPT-6 系统卡解读:幻觉问题半年内已大幅改善
inductionheads · x · 2026-10-08
Andrew Curran 转发并评论:认为幻觉对当前模型是不可解问题的人,需要根据现实和趋势更新认知,过去半年变化巨大。其引用的是 OpenAI 部署安全中心发布的 GPT-6 Sol 与 GPT-6 Luna 十月系统卡:
- GPT-6 已向 ChatGPT 全球免费与付费用户全量推送,替代 GPT-5.6 Sol/Luna
- 引入 Astra 安全进展,更新安全训练以加强针对网络、生物、暴力等高风险滥用的防护
- 对比 GPT-5.6:抗越狱能力更强(包括多轮自适应攻击),不诚实、欺骗与绕过护栏行为减少
- 在 Preparedness 框架下,十月版 GPT-6 在网络安全与生物化学领域被评为 High 能力,AI 自我改进未达 High 阈值
核心论点是:从系统卡的量化安全评估看,模型可靠性的方向性改善是明确的。
「模型」频道最新
- Grok Bot 获原生 X 搜索能力,可批量读取推文但暂不能代发 — rohanpaul_ai · 2026-10-08
- 双 CMP 170HX 共 128GB 跑 GLM-5.3-Flash:384K 上下文约 90 tok/s — Prudent_Appearance71 · 2026-10-08
- 微软 Windows 发布会展示 GitHub Copilot 支持本地 AI 运行 — film_girl · 2026-10-08
- Aleph Alpha 开源德语模型 Kolibri:78B 参数每词仅激活 3B — lmoroney · 2026-10-08
- ChatGPT 更新翻车?用户晒报错截图劝大家去摸草 — TheMoonMidas · 2026-10-08
- 4700 会话实测 Jev Router:成本高 38%,可操控性接近 Opus 5.5 — arena · 2026-10-08