Grok 4.5 登上榜单
scaling01 · x · 2026-07-09
Grok 4.5 登上了排行榜,被转发者称为一个“令人印象深刻的进步”。这条帖子的核心信息是模型在基准/榜单上的表现提升,而不是其他产品话题。
所属事件:Grok 4.5发布并登上Vals榜单第六名(2 条相关)→
「模型」频道最新
- 用户对比:Astra 写作风格明显优于 5.6 Sol — haider1 · 2026-09-07
- Astra 自估距 AGI 很远,但配上工具使用后评分接近 — kevinnbass · 2026-09-07
- GLM 5.3、Qwen 3.8 可在单机本地流畅运行 — jasonkneen · 2026-09-07
- 新基准测模型自我建模:开源模型经RL提升但反事实仍易错 — dair_ai · 2026-09-07
- Alexandr Wang 点评 Muse Spark 1.3:时间跨度比肩 GPT-5.6 — alexandr_wang · 2026-09-07
- 实测者泼冷水:Astra 展示强但单步推理仍够不到研究级 — xiaosun86 · 2026-09-07