专题 · FULL STORY

GPT-5.6面世:从系统卡到极速推理

OpenAI发布GPT-5.6系统卡,披露Sol等三款模型;随即联手Cerebras推出Ultrafast预览,每秒最高750 token,提速14倍。

2026-08-13 ~ 2026-08-17 · 3 集 · 24 条

第 1 集 · OpenAI 发布 GPT-5.6 系统卡,Sol 模型经70万小时红队测试(2026-08-13,2 条)

OpenAI 发布了 GPT-5.6 系统卡,涵盖旗舰模型 Sol、低成本模型 Terra 和高效模型 Luna。系统卡显示这些模型在网络安全和生物化学风险方面被评为高能力。为增强模型安全性,OpenAI 特别对旗舰模型 Sol 进行了超过 70 万小时的自动化红队对抗训练,以提升其鲁棒性。

第 2 集 · OpenAI携手Cerebras推出GPT-5.6超快模式(2026-08-14,20 条)

OpenAI 与芯片厂商 Cerebras 联合预览 GPT-5.6 Sol 的全新 Ultrafast 服务层级,输出速度最高每秒 750 token,比标准处理快 14 倍,官方称智能水平不变。该功能已在 OpenAI API 向部分客户限量预览,将随容量增长逐步开放,主要面向对时间敏感的商业应用。Cerebras 芯片直接驱动 OpenAI 旗舰模型 API,被视为大模型推理竞速的标志性事件。

已确认

  • 极致性能:最高每秒生成 750 个 token,比标准处理快 14 倍,且不损失智能水平。
  • 技术原理:据量子位、机器之心报道,速度提升得益于 Cerebras 晶圆级引擎,模型权重直接置于芯片 SRAM,突破了传统 GPU 的显存带宽瓶颈。
  • 官方实测:针对同一构建金融终端仪表盘的提示词,标准模式耗时 12 分 20 秒;在 Humanity's Last Exam 测试中,模型仅用 11 小时完成。
  • 竞品对比:据 petrusenkomax,在 2500 道博士级问题上比 Claude Fable 5 快近 7 倍,经济知识任务提速 5.6 倍;据 eyishazyer,Cerebras 宣称其芯片使 OpenAI 处理速度比 Claude 快 11 倍。
  • 推出节奏:目前为限量预览,率先在 OpenAI API 向一组精选客户推出,随容量增加逐步扩展。
  • 模型优化:据新智元,《GPT-5.6 构建者指南》显示,改用 Responses API 并开启「推理保留」与「压缩」后,GPT-5.6 Sol 在 ARC-AGI-3 上的成绩升至 38.3%。
  • 业界反应:Peter Diamandis 测算按此速度不到 3 分钟即可写完一部 9 万字小说,认为知识工作的经济格局将因此永久改变;另有转发帖提及前高管感叹 Hugging Face 前景堪忧。

尚未确认

  • 具体客户名单、详细定价方案及全面开放时间表尚未公布。

为什么重要

  • 商业价值:每秒 750 token 的生成速度大幅降低响应延迟,直接利好时间敏感的企业级应用。
  • 行业趋势:Cerebras 芯片直接驱动 OpenAI API,体现软硬件深度绑定的趋势,或加剧大模型推理市场竞争;DeryaTR 等转发帖认为这标志着 AI 进入「速度时代」。

第 3 集 · OpenAI 携手 Cerebras 推超快模式,提速 14 倍(2026-08-16,2 条)

OpenAI 与芯片公司 Cerebras 达成合作,为 GPT-5.6 Sol 推出 Ultrafast 超快模式预览,面向特定客户开放。该模式推理速度最高提升 14 倍,输出速率可达每秒 750 个 token,远超现有水平。有观点认为,这种量级的生成速度将改变人与 AI 的交互范式。