Opus 5.5 七场对决六胜 GPT-6 Sol
Anthropic 的 Opus 5.5 与 OpenAI 的 GPT-6 Sol 在同日仅隔几分钟相继发布,博主 @alexverem 随即选取七组代表性任务进行逐一评分对比,最终 Opus 5.5 以 6:1 大胜 GPT-6 Sol,唯一败绩是速度与成本占优的熔岩灯一局。这组评测因覆盖代码生成、3D 建模、硬核工程实战和订阅性价比等多个维度,成为两模型对比中被广泛引用的参考。
已确认
- 第 1 场(Three.js 埃菲尔铁塔,四模型横评):Opus 5.5 花费 $8.95/10 分钟,GPT-6 Astra $7.45/8 分钟,GPT-6 Sol $3.90/5 分钟,Kimi K3 也参与;作者认为 Opus 成品最惊艳。
- 第 2 场(熔岩灯):GPT-6 Sol 仅 50 秒、8 美分取胜;Opus 5.5 用时 9 分 35 秒、花 $1.27;GPT-6 Astra 为 $0.63/5 分 4 秒,GPT-6 Luna 不到 1 美分。
- 第 3 场(Blender 同 prompt 建 3D 场景):Sol 约 $34.55、更快,但绑骨与几何有明显问题;Opus 花 $48.11、更慢,成品细节与氛围明显更精致。
- 第 4 场(单 HTML 钓鱼游戏):Sol 更快、代码更小更干净,但仅 1 种鱼、2 个升级;Opus 做出 5 种鱼、稀有度分级、完美捕捉机制、3 条成长树、动态鱼群、小地图等完整玩法。
- 第 5 场(同 prompt 各做游戏):作者评价差距「不在一个级别」,并称 Opus 5.5 是其见过最好的模型,此场判 Opus 胜。
- 第 6 场(Intel Arc B70 实战):Opus 5.5 用 2 小时让 exl3 跑通并修好 decode、prefill、并发、MTP 和视觉;作者称此前用 Sol 追同一目标数周无果。
- 第 7 场(订阅性价比):Claude Pro($20)下 Opus 5.5 high 连续跑了近 2 小时才触发 5 小时限额,每个 5 小时窗口约仅占每周用量的 15%,作者认为远超 $20 ChatGPT Plus 的用量。
- 总比分:Opus 6 胜(埃菲尔铁塔、Blender、钓鱼游戏、同 prompt 游戏、GPU 实战、订阅额度),Sol 1 胜(熔岩灯)。
尚未确认
- 全部结论出自 @alexverem 一人评测,其自称偏好 Opus,结果带有主观判断成分,未经独立复现。
为什么重要
- 两大旗舰模型同日发布本就罕见,这组七场对决覆盖创意生成、工程质量与成本效率,为选型提供了多维参考;尤其是 Intel Arc B70 这类长周期硬核任务和 $20 订阅额度的实测,直接关系到重度用户的实际成本与生产力判断。
2026-09-25 ~ 2026-09-25 · 9 条相关
一手来源
- Opus 5.5 与 GPT-6 Sol 同日发布,作者实测 7 组对决 — alex_verem ·
- 七场对决终局:Opus 5.5 六胜一负碾压 GPT-6 Sol — alex_verem ·
- 2 小时干完 3 个月的活:Opus 5.5 跑通 Intel Arc B70 — alex_verem ·
- 【源头】Opus 5.5 与 GPT-6 Sol 同日发布,作者实测 7 组对决 — alex_verem · 2026-09-25
- Three.js 埃菲尔铁塔四模型横评:Opus 5.5 最惊艳 — alex_verem · 2026-09-25
- 熔岩灯对决:GPT-6 Sol 8 美分 50 秒,唯一赢 Opus 一场 — alex_verem · 2026-09-25
- Blender 实测:Sol 便宜 $14,Opus 成品更精致 — alex_verem · 2026-09-25
- 单 HTML 钓鱼游戏对决:Sol 更快,Opus 做出真游戏 — alex_verem · 2026-09-25
- 同一 prompt 做游戏:Opus 5.5 与 GPT-6 Sol「不在一个级别」 — alex_verem · 2026-09-25
- 【源头】2 小时干完 3 个月的活:Opus 5.5 跑通 Intel Arc B70 — alex_verem · 2026-09-25
- $20 订阅实测:Opus 5.5 连跑近 2 小时才撞限额 — alex_verem · 2026-09-25
- 【源头】七场对决终局:Opus 5.5 六胜一负碾压 GPT-6 Sol — alex_verem · 2026-09-25