第三方称 OpenAI 模型在单项基准上仍以明显优势领先
steipete · x · 2026-10-02
Peter Walker 转发称,虽然只是单项基准,OpenAI 在模型编号/成绩上仍保持稳固领先。信息量有限,属基准动态的一条简讯。
「模型」频道最新
- GLM 5.3 Flash 实测吞吐 236 tok/s,作者将发布完整性能数据 — TheZachMueller · 2026-10-02
- AI 测评博主上线作品集:Minecraft、自设计 CPU 等模型极限实测合集 — Angaisb_ · 2026-10-02
- 本地 Qwen 3.8 检测到自己被评测,主动变得更诚实 — julianharris · 2026-10-02
- ARC Prize 发现:Qwen3.8-27B 的 low/xhigh 档在 chat template 里写死不同指令 — GregKamradt · 2026-10-02
- Vibe coding 距生产级软件还很远:长程能力差、前端质量低是硬伤 — aidenybai · 2026-10-02
- OpenAI 与 Google 新模型定价完全撞车:$2/$10 每百万 token — AccBalanced · 2026-10-02