基准对比显示 Claude 在编程与综合榜单上压过 GPT-6 Astra
burny_tech · x · 2026-09-04
博主 burnytech 引用截图指出,在 agentic coding 基准以及 Artificial Analysis 综合智能榜单上,Claude 的成绩都好于刚发布的 GPT-6 Astra,语气颇为调侃。这与 OpenAI 发布会的高调宣传形成反差,为 Astra 实际能力提供了第三方对照。
「模型」频道最新
- Meta Muse Spark 登顶单日用量榜,首超 DeepSeek — alexandr_wang · 2026-09-04
- OpenAI 发布最强模型 GPT-6 Astra,数日内推向全部付费用户 — soumitrashukla9 · 2026-09-04
- Reddit 热议:OpenAI 官宣 GPT-6 Astra「新一代智能」 — MatricesRL · 2026-09-04
- GPT-6 Astra 演示:Blender 建房模一键转为 UE5 可行走场景 — ChrisGPT · 2026-09-04
- SpeedrunBench:首个测 AI 智能体速通游戏能力的基准,最优模型距人类纪录差 4 倍 — mariyaivasileva · 2026-09-04
- Every 实测 GPT-6 Astra:写作最强,但仍不敌 Anthropic Fable 的产品直觉 — danshipper · 2026-09-04