Grok 4.5 编程效率很强
XFreeze · x · 2026-07-15
转发内容称,Grok 4.5 在 FrontierSWE 基准上展现出很强的编程效率:在成绩顶尖的同时,使用的 token 明显更少。
文中给出的对比是:
- 对比 Fable 5,平均总 token 约 20.1M vs 116.9M
- 平均墙钟时间约 229 分钟 vs 450 分钟
- token 用量接近 少 6 倍,时间也大约减半
核心结论是:Grok 4.5 不是靠堆 token 和算力硬刷,而是在更节省资源的情况下拿到高分。
所属事件:Grok 4.5 跃居 FrontierSWE 第二(5 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03