Grok 4.5 实测:大上下文更便宜更快
socialwithaayan · x · 2026-07-18
作者称自己原本没想到会对 Grok 4.5 这么惊艳,但实际测试后改观。
他提到几个核心点:
- 上下文窗口达到 500K tokens,能一次塞进整个项目文件并保留前后细节;
- 速度快,回复比预期短得多;
- 成本大约比 Claude Opus 4.8 每任务便宜 60%;
- 在 Artificial Analysis 榜单上排第 4;
- 据称与 Cursor 一起训练,更适合真实代码仓库里的多步任务;
- 还能直接接入 X 的实时数据。
作者的结论是:它不只是“便宜替代品”,而是很多非一次性任务里的更聪明默认选择。
所属事件:Grok 4.5 低成本高效率引热议(10 条相关)→
「模型」频道最新
- DeepSWE评测:Kimi K3达到Claude Fable 5同等能力,成本仅35% — togethercompute · 2026-07-22
- 实测对比:Gemini 3.5 Flash在轻量编程任务中优于GPT-5.6 — Shick_hydro · 2026-07-22
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE — JLeonsarmiento · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22