专题 · FULL STORY

GPT-5.6 Luna大降价与隐藏性能曝光

OpenAI 宣布 GPT-5.6 系列模型大幅降价,其中 Luna 模型价格暴降 80%。实测显示其性价比全面反超竞品,同时社区发现开启 Codex Max 推理模式可进一步激发模型潜力,引发热议。

2026-07-30 ~ 2026-08-02 · 4 集 · 28 条

第 1 集 · GPT-5.6 Luna降价80%实测:性价比全面反超(2026-07-30,15 条)

OpenAI宣布GPT-5.6 Luna模型降价80%,成为同级别中性价比最高的模型。实测表明,Luna在智能指数上超越Google最强竞品,且使用成本低于主流开源权重模型,推理速度提升60%以上,达到近200 tok/s。这一降价标志着大模型行业从拼算力转向拼落地性价比,开源模型在成本端的传统优势正面临严峻挑战。

已确认

  • 降价与性价比反超:官方宣布Luna降价80%,成为同级别中性价比最高的模型。@BenBajarin基于CS Bench实测指出,Luna在提供更高质量的同时,使用成本甚至低于主流开源权重模型。@Angaisb横评显示,按AAI总成本计算,Luna花费仅为Gemini 3.6 Flash的四分之一。@downingARK的图表也表明,Luna在几美分成本下即可获得与Opus 5 low模式大致相同的智能评分。@EverydayAI称,Luna综合能力与Sonnet 5相当,但成本效益达25倍。
  • 成本与速度骤降:@charliermarsh对比指出,Token价格在4个月内缩水至十三分之一(GPT-5.5输入/输出$2.50/$15,而Luna仅为$0.20/$1.20)。@AccBalanced补充,即便用B200芯片且未优化,实际服务成本也已跌破3美元,但该优势尚未完全传导至所有API端点。此外,@brandongalang实测发现Luna推理速度提升60%以上,达到近200 tok/s。
  • 代码安全能力:@cramforce引用Vercel AI Gateway的DeepsecBench榜单证实,降价后Luna在xhigh推理模式下超越了Sol模型。

尚未确认

  • @teortaxesTex指出,在智能体场景下,Luna的缓存读取成本仍高出DeepSeek V4-Pro 5.5倍,且存在长序列惩罚和额外缓存写入费用,认为DeepSeek在此场景更具优势。这一观点暂未得到其他帖子验证。

为什么重要

  • API价格断崖式下跌和统治级性价比模型的出现,极大降低了AI应用门槛。官方核心研究方向是打造针对任意智能水平的高效模型,期待开发者在“便宜到无视”的成本下进行创新。

第 2 集 · 开启 Codex Max 推理模式可大幅降本增效(2026-07-31,3 条)

近期多位用户发现,OpenAI Codex 默认关闭了 Max 级别的推理能力,建议开发者手动开启。开启该隐藏选项后,GPT-5.6 Luna 模型在 Max 推理模式下的表现可媲美 Opus 5 或 Sol Medium,同时能显著削减使用成本。据实测反馈,该模式最高可节省约六成至 83% 的开销,实现性能与成本的双重优化。

第 3 集 · GPT-5.6 系列跑分曝光:Sol 性能强劲 Luna 性价比高(2026-08-01,3 条)

OpenAI 即将推出的 GPT-5.6 系列模型最新跑分曝光,引发社区热议。LMSYS Arena 数据显示,GPT-5.6 Sol (xHigh) 在文本任务中跻身榜单前十;而 GPT-5.6 Luna Max 则以极高的性价比成为日常首选,单任务成本仅 0.61 美元且得分达 67%。分析师实测指出,Luna 在知识工作场景下的表现已与 Sol 比肩,但成本大幅降低。

第 4 集 · OpenAI大幅降价GPT-5.6系列,Luna降80%(2026-08-01,7 条)

OpenAI官方宣布对GPT-5.6系列模型实施大幅降价,其中Luna模型输入价格暴降80%至$0.20/百万tokens,输出价格降至$1.20/百万tokens;Terra降价20%;Sol维持原价,但新增Fast模式,处理速度最高提升2.5倍。新计费方式已同步反映在Codex和ChatGPT Work的额度扣减中。此次降价引发开发者社区广泛关注,用户实测显示Luna在开启Max effort和Fast模式后,综合表现可媲美此前的主力模型Sol 5.6 Medium,且成本更低,成为Plus账号的高性价比新选择。

已确认

  • 价格调整:Luna降价80%,Terra降价20%,Sol维持原价。
  • Fast模式:Sol新增Fast模式,处理速度最高提升2.5倍。
  • 计费同步:新价格已反映在Codex和ChatGPT Work的额度扣减中。
  • 用户实测:@Glxblt76 实测显示Luna在Max effort和Fast模式下性能媲美Sol 5.6 Medium。

尚未确认

  • 内部模型Astra的数学突破及沙盒逃逸事件仅为传闻,未获官方证实。

为什么重要

  • 降价降低了开发者和学术研究者的使用门槛,OpenAI本周还为学术研究者开放了免费前沿模型访问(10万科学家)。
  • 加剧了AI大模型领域的商业竞争,Luna的高性价比可能吸引更多用户。