Opus 5.5 多数基准领先 GPT-6 Astra,科学终端基准仍落后
BenBlaiszik · x · 2026-09-23
Anthropic 官方宣布 Opus 5.5 相比 Opus 5 是重大跃升,在 agentic coding、computer use 和知识工作三方面领先。第三方对比显示,Opus 5.5 在多数基准上超过 Fable 5.1 和 GPT-6 Astra,但 GPT-6 Astra 在 Terminal-Bench-Science 上仍明显领先,发帖人就此征求社区对差距原因的假说。
所属事件:Claude Opus 5.5 登顶 AA 智能指数并降价约 20%(78 条相关)→
「模型」频道最新
- 博主实测称 Anthropic Opus 5.5 对话体验出色 — daniel_mac8 · 2026-09-23
- Opus 5.5 与 GPT-6 Sol/Luna 一夜齐发,OpenAI 价格砍半抢市场 — AlchainHust · 2026-09-23
- 实测者称 Claude Opus 5.5 拥有迄今最好的视觉设计能力 — repligate · 2026-09-23
- MachgenAI:账户余额超25美元可免费用Minimax H3 Turbo生成 — TheMoonMidas · 2026-09-23
- 研究者观察:爱晒AI吹捧自己的多是反社会行为者 — repligate · 2026-09-23
- 评Opus 5.5:语料满是摘要的摘要,一手经验最稀缺 — mimi10v3 · 2026-09-23