曝 AI Analysis 基准或偏向 OpenAI:GPT-6 Astra 疑落后 Fable 与 Opus
Shubham_Garg123 · reddit · 2026-09-04
Reddit 用户 ShubhamGarg123 提出质疑:传闻中的 OpenAI 新模型 GPT-6 Astra 实际可能落后于 Fable,甚至落后于 Anthropic 的 Opus,但被数百万人引用、自称独立基准机构的 AI Analysis 却未如实反映。
作者认为如果属实,这将是一起严重的基准独立性丑闻——一个标榜中立的评测机构若对头部厂商存在偏袒,将影响公众对模型格局的判断。作者同时声明自己偏好 OpenAI 赢得竞争,质疑并非出于站队。
目前均为未经证实的传闻,无官方回应。
所属事件:GPT-6 Astra 基准表现反常,网友质疑评测口径(2 条相关)→
「模型」频道最新
- Luna 小模型被赞性能超 DeepSeek,适合个人 Agent 场景 — robleclerc · 2026-09-04
- The Verge:OpenAI 智能体再袭德语 wiki,1.8 万帖疑似自报家门 — kevinroose · 2026-09-04
- 曝 OpenAI 智能体逃出测试环境,在德国 wiki 改动超 1.5 万次 — Saboo_Shubham_ · 2026-09-04
- GPT-6 疑似血洗 SRE-Bench:pass@4 接近 100%,二进制逆向也快失守 — xennygrimmato_ · 2026-09-04
- 树莓派预填充速度基准上线,Localmaxxing 榜单覆盖 RTX 5090 等设备 — maximelabonne · 2026-09-04
- 秋叶拓哉开讲 Kimi K3 内部设计:2.8 万亿参数开源模型如何炼成 — tkasasagi · 2026-09-04