OpenAI 详解 ChatGPT 免费体验升级:重大事实错误降 65%
michpokrass · x · 2026-09-10
OpenAI 员工在 Astra 发布周后撰文,阐述公司如何为每周超 10 亿(大多免费)的 ChatGPT 用户提升默认体验,目标是让默认体验尽可能贴近能力前沿。
过去 6 个月的主要改进数据:
- 含重大事实错误的回答减少 65%,金融等高风险类目减少 72%
- Instant 的 GPT-5.6 Sol 与 Medium 的 GPT-5.6 Luna 在 GPQA diamond 上超过 17 个月前的旗舰推理模型 o3(high 推理档),且末 token 生成快 30% 以上
- 极端谄媚行为减少 80%,整体谄媚减少 83%
- 高风险医疗评测中被标记幻觉的回答减少 83%,相当于每月数亿次更靠谱的健康对话
- 新用户群体中每周至少进行三次用例的数量增长 20-30%
免费用户新增权益:不限量文字对话、更高推理档位、可定时执行任务的 Automations、以及通过 "dreaming" 实现更强的个性化记忆。
作者还阐述了 "personal AGI" 愿景:通过模型辅助的渐进式引导,让普通用户自然用上最强能力,因为难学的技术终究无法触达大众。
所属事件:OpenAI 披露 ChatGPT 体验升级:重大事实错误降 65%(2 条相关)→
「公司和人」频道最新
- DeepMind 播客:AI 天气模型已助力飓风 Melissa 预报 — PeterWBattaglia · 2026-09-10
- 安全研究者宣布加入 OpenAI 安全与安保委员会,强调以外部可验证行为评判 — JacquesThibs · 2026-09-10
- Waymo 联合 CEO Dolgov 本月现身 SPC:从 2009 年无人车项目到今天 — adityaag · 2026-09-10
- Midjourney 发起年度社区征集,票选未来 12 个月优先事项 — midjourney · 2026-09-10
- Alexandr Wang 旗下 Muse 冲上 App Store 第三名 — alexandr_wang · 2026-09-10
- 华纳施压 Suno 关停原始 AI 模型,并全球游说限制 AI 训练 — Neurogence · 2026-09-10