BridgeBench 实测:Grok 4.7 比 4.6 贵 50%、慢 60%
socialwithaayan · x · 2026-09-23
BridgeBench 用相同的 lava lamp 测试对比 Grok 4.7 与 4.6:4.6 花费 $0.23、用时 9 分 54 秒;4.7 花费 $0.35、用时 15 分 46 秒——贵 50%、慢 60%,且输出仍达不到可用于真实前端开发的水平。作者结论:Grok 原本的优势是便宜和快,如今价格上升、速度变慢,质量差距依旧,是明显的退步。
「模型」频道最新
- Anthropic 预告:Sonnet 5.5 与 Haiku 5.5 将于数周内发布 — mikeyk · 2026-09-23
- Opus 5.5 发布:比 Opus 5 便宜 25%,一键成功率被称惊人 — bindureddy · 2026-09-23
- 开发者自述:没有全能模型,主力 Agent 换着用,杂活交给中国模型 — iannuttall · 2026-09-23
- Opus 5.5 登顶 Artificial Analysis 智能指数榜首 — UnknownEssence · 2026-09-23
- 某基准测试结果离奇,用户建议仍用 Opus 5.5 中等档 — Yuchenj_UW · 2026-09-23
- Nathan Lambert:OpenAI 模型 scaling 正常,Claude 却呈「地震形」曲线 — natolambert · 2026-09-23