Ship 称以约一半成本追平 Opus 4.8 和 GPT-5.6 Sol
minchoi · x · 2026-07-22
- Ship 宣称可以用大约 一半成本 达到与 Opus 4.8、GPT-5.6 Sol 相近的效果。
- 配图对比了 Terminal-Bench、SWE-bench Verified、Aider Polyglot、LiveCodeBench、ARC-AGI-2、MMLU、IFEval、GPQA Diamond 等基准上的解题率。
- 下半部分展示单任务成本,Ship 在不少项目上明显更便宜,同时分数接近灰色基线。
- 帖子还强调,只需改一行代码,就能切到 Ship 并保持能力与行为一致。
所属事件:TheSean Labs推出Ship:号称将前沿模型推理成本减半(5 条相关)→
「Infra」频道最新
- Unsloth 号称单张 4090 就能微调 7B 模型 — thisdudelikesAI · 2026-07-22
- SkewAdam 把 6.78B MoE 优化器状态压到 1.29GB — Nuemaan Malik · 2026-07-22
- 开放权重模型或推高硬件需求,因为它们解锁了新工作负载 — bookwormengr · 2026-07-22
- 中文模型已不稀奇,2026 代国产算力集群才是大新闻 — teortaxesTex · 2026-07-22
- LLM 推理 benchmark 可能骗人,关键是测真实流量 — Suspicious_Orchid770 · 2026-07-22
- Mark Cuban 预言不少 AI 数据中心可能改成球场 — 2C_ornot2C · 2026-07-22