GPT-5.6 系列跑分曝光:Sol 榜单前十,Luna 性价比成日常首选
arena · x · 2026-08-01
LMSYS Arena 竞技场最新数据显示,OpenAI 即将推出的 GPT-5.6 系列模型在各项基准测试中表现强劲。其中 GPT-5.6 Sol (xHigh) 在文本、视觉和文档处理榜单中均跻身前列,整体实力可与 Anthropic 的 Claude 5 系列顶尖模型抗衡。
此外,分析师指出 GPT-5.6 Luna (xHigh) 在保持与 Sol 相近能力的同时,单次任务成本大幅降低,极具性价比,有望成为重度知识工作者的日常首选模型。
「模型」频道最新
- 实测Claude Opus隐藏提示词,生成诡异“Dario与Amanda”图像 — chicametipo · 2026-08-01
- 开源模型逼宫?网友调侃某厂商因DeepSeek被迫降价80% — InternationalGap3698 · 2026-08-01
- 实测:用 Prompt 让 Claude 写代码构建骨骼动画系统 — chongdashu · 2026-08-01
- 18家主流大模型API价格横评:同等工作负载成本相差百倍 — mentorperplexed · 2026-08-01
- 18个大模型API成本对比:最高相差超百倍 — mentorperplexed · 2026-08-01
- 用户吐槽 Claude Opus 5 体验翻车:新版反而更难用 — vivekhaldar · 2026-08-01