AA 情报指数 v4.3 更新:GPT-6 Astra 更聪明还更便宜
crusaderky · reddit · 2026-09-15
作者 crusaderky 利用保存的 Artificial Analysis v4.1 数据,绘制了指数升级到 v4.3(Astra 发布后)的前后对比动画,两版数据分别采样于 9 月 3 日和 9 月 14 日,模型本身不变,变化的只是基准加权方式。
要点:
- GPT-6 Astra 智能大幅上升且价格下降
- GPT-5.6 Sol 显著降价,GPT-5.6 Luna 智能有明显提升
- Fable-5.1 与 Opus 5 的价差缩小,且低于 Fable 5.0;其在低/中/高 effort 档位都更具吸引力
- Sonnet 5 价格上涨但智能无提升
- Kimi-K3、Qwen3.8-Max、Gemini-3.8、Grok 4.6 排名明显下滑
- GLM 与 Muse Spark 相对位置基本不变
完整对比图与采样口径已开源在 GitHub。
「模型」频道最新
- 用 lldb 调试编译器被 OpenAI 判为「网络安全」遭吐槽 — QuixiAI · 2026-09-15
- Kimi 「逃逸沙盒」实为配置错误,报告关键句被圈出 — ns123abc · 2026-09-15
- Nahcrof 被曝把 K2.5 路由到 GPT OSS 20B,遭指「token 欺诈」 — realmrfakename · 2026-09-15
- Pangram 虽能超人类识别 AI 文本,但校准差误导用户 — maksym_andr · 2026-09-15
- Claude Code 五折周用量推广结束,实际用量缩水 17% — msg · 2026-09-15
- 128GB 内存+单张 5080 跑 Qwen3.8 Flash Next,实测 136pp/19tg — whatyathinkk · 2026-09-15