Rippling 实测:Opus 微弱领先,$7B 收购暗示智能路由价值

serendip-ml · reddit · 2026-08-19

Rippling 对 15 个模型进行了 2100 次真实薪酬工作的基准测试。结果显示:未调优模型成功率约 88.5%-89.5%,Z.ai GLM 5.2 耗费 $621 达到 88.7%,而 Anthropic Opus 4.6 作为唯一经过提示调优的模型达到 91.0%,但花费 $1,453 且仍有 9% 失败率。 weeks 后,Stripe 假设性以 $7B 收购 OpenRouter,后者月处理约 100 万亿 Token,ARR 约 $1.4M。这引发了一个核心问题:未来的 Agent 推理是需要复杂的“思考”,还是主要依赖简单的结构化输出?智能路由究竟是刚需还是伪需求?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →