GPT-5.6 超越 Sonnet 且成本极低
reach_vb · x · 2026-08-16
评测显示,GPT-5.6 Luna Max 在 DeepSWE v1.1 上得分比 Sonnet 5 Max 高出 13.3 分,但成本仅为后者的 1/44。DeepSWE 测试包含 113 个长周期工程任务。
「模型」频道最新
- 用户实测:Google AI 搜索 3.6 与 3.7 模型差异极小 — gaganghotra_ · 2026-08-17
- 当前模型可能缺乏隐秘能力,但这并非绝对 — TheZvi · 2026-08-17
- 预训练决定AI上限,目前这个盒子还不够大 — pmddomingos · 2026-08-17
- Grok 安全拦截少,体验优于 Claude — billyjhowell · 2026-08-16
- Claude 被指爱用急转修辞,营销文案槽点多 — churchkey · 2026-08-16
- Qwen3.8-27B推出IQ4_XS量化版,16GB显存可运行 — Johnny_Rell · 2026-08-16