实测对比:GPT 5.6 Luna Max 成本低但难产出可用代码
alexcovo_eth · x · 2026-08-05
开发者在为期两天的多轮测试中对比了 GPT 5.6 Luna Max 和 Sol Medium 两款模型。
- 成本与限制:Luna 的 Token 单价显著更低,平均每轮对话成本约 $1.20,而 Sol 高达 $29。但 Luna 消耗的 Token 数量更多,也会影响订阅的速率限制。
- 代码质量:尽管 Luna 便宜,但在实际应用中无法产出可直接交付的代码,开发者不得不重做大部分工作,导致低成本只是错觉。
- 上下文表现:随着对话变长,Luna 容易忽略初始指令,并在基础任务上迷失;相比之下 Sol 表现更稳定。使用 Opus 5 审查两者的代码也证实了 Luna 的质量缺陷。
「模型」频道最新
- 前沿大模型为何频现傲慢与拒绝?RLVR 训练机制或是元凶 — SpiritRealistic8174 · 2026-08-05
- DeepSeek v4 Flash 等本地模型编程实测:Qwen 122B 性价比反超 — returnity · 2026-08-05
- 通义千问 3.8-Max 视觉能力登顶 EyeBench 榜单第二 — adonis_singh · 2026-08-05
- 吐槽 Claude Opus 5 输出啰嗦,开发者呼吁精简提示词 — mattpocockuk · 2026-08-05
- Grok 4.5 登顶 VulcanBench,编程任务解决率与成本双杀 — XFreeze · 2026-08-05
- MiniMax-H3 视频生成:仅改语言标签,人物种族随之改变 — pocketpunk9527 · 2026-08-05