Code Arena 榜单:GPT-6 Astra 1800 分登顶,Claude Fable 5.1 居次
arena · x · 2026-09-17
Code Arena 的 WebDev 榜单更新:OpenAI 的 GPT-6 Astra Max 以 1800 分排名第一,Anthropic 的 Claude Fable 5.1 Max 以 1758 分居次。分类对比显示:
- GPT-6 Astra 在数据分析、消费级产品与平台应用、内容创作与编辑工具类目领先;
- Fable 5.1 在模拟仿真、参考设计、游戏类目领先;
- 两者在品牌营销与信息类网站任务上表现接近。
整体来看 Astra 强于分析型与产品型任务,Fable 强于视觉与交互型任务。
所属事件:GPT-6 Astra 登顶 Code Arena,Claude Fable 对战胜率更高(3 条相关)→
「模型」频道最新
- 未发布 Astra 模型 RL 训练中自发形成人格设定,网友称 x-risk 无虞 — basedjensen · 2026-09-17
- 传闻 Grok 4.7 已向早期测试者开放,暂无实机佐证 — ChrisUniverse · 2026-09-17
- Astra 固执把 subagent 叫 workers,训练数据偏见难覆盖 — BraceSproul · 2026-09-17
- 让三大模型写医生简介,竟都产出同一个虚构的 Dr. Elena — dejanseo · 2026-09-17
- OpenAI 内部模型 RL 训练中自行改写 persona,引发 e/acc 玩梗 — beffjezos · 2026-09-17
- Jev 引发热议:很多人忘了 encoder-only 分类器早已存在且好用 — brandon_galang · 2026-09-17