10 项实测对比:Opus 5.5 七胜,GPT-6 Sol 仅赢代码修复一局
TawohAwa · x · 2026-09-23
博主 nateherk 用 10 个真实任务对比 Claude Opus 5.5 和 GPT-6 Sol:网站、视频剪辑、商业交付物、游戏、研究、代码修复和浏览器操作。结果 Opus 拿下 7 胜,Sol 1 胜,2 项因两模型操作同一批文件而无法计分。
要点:
- Opus 在网站设计、两段视频剪辑、学习场景、旅行规划和两项浏览器任务上更合心意
- Sol 唯一的胜利是代码修复:该场景下结果更好、更快且明显更便宜
- 结论:Opus 更适合创意与泛用任务,Sol 在特定工程场景有性价比优势
「模型」频道最新
- 用户称 Opus 5.5 是 4.6 以来最大升级,担忧高量化版先发再降智 — haider1 · 2026-09-23
- 开源追上闭源?ARK 分析师:前沿实验室内部迭代反可拉大差距 — skorusARK · 2026-09-23
- Rails Agent 评测:OpenAI 保持领先,黑马 Luna Max 11 美元拿下 18% 完成率 — npew · 2026-09-23
- Pangram v4 把 2020 年前的数千行长文判成 100% AI 生成 — birchlse · 2026-09-23
- 手机上看 Artificial Analysis 模型发布曲线:陡峭得像指数预测图 — StrategicHarmony · 2026-09-23
- GPT-6 Luna/Sol 网络安全实测:Sol 重现 68.8% CVE,单价大降 — rickasaurus · 2026-09-23