GPT-5.6 Luna Max 实测:成本极低但代码质量翻车
petrusenko_max · x · 2026-08-05
近期对 GPT 5.6 的两个版本 Luna Max 和 Sol Medium 进行了为期两天的实测评估。
- 成本对比:Luna 单次会话成本约 1.20 美元,远低于 Sol 的约 29 美元。
- 能力缺陷:尽管成本低廉,Luna 在长对话中经常忽略指令,无法生成可直接交付的代码,且引入了更多 P1 级别的严重回退问题。
- 综合结论:Opus 5 和 Sol xhigh 的审查均指出,尽管 Sol Medium 成本较高,但产出的结果更好,印证了最初的评估判断。
所属事件:GPT-5.6 Luna Max实测成本低但代码质量不佳(2 条相关)→
「模型」频道最新
- 日均烧 13 万美元?DeepSeek API 真实调用量揭秘 — teortaxesTex · 2026-08-05
- 实测 12 个大模型修 Bug:最便宜的模型反而最烧钱 — deusaquilus · 2026-08-05
- 曝OpenAI新模型gpt-5.6-luna因性价比过高致服务器过载 — _lewtun · 2026-08-05
- Anthropic Opus 5 被指输出严重退化:满口术语 — TheTuringPost · 2026-08-05
- Mach-1 Additive被指以十分之一体积达到Qwen 3.6 35B九成五性能 — MuzafferMahi · 2026-08-05
- AI 也需要补觉?开发者曝光 GPT 思维链搞笑翻车 — cantrell · 2026-08-05