Opus 5.5 跑分强势,网友开始为 GPT-6 Sol 担忧,但 Opus 5 前车之鉴犹在
Angaisb_ · x · 2026-09-23
- Opus 5.5 在基准测试上表现很强,Angaisb 表示开始为 GPT-6 Sol 感到紧张。
- 但他提醒:Opus 5 当年跑分也曾高于 Fable 5,用户实际体验却不买账,最终表现如何仍需观察。
所属事件:Claude Opus 5.5 登顶 AA 智能指数并降价 20%(6 条相关)→
「模型」频道最新
- Anthropic 传闻级好评:Opus 5.5 被称 S 级发布,用量额度还涨 25% — EricBuess · 2026-09-23
- Anthropic 承认 Opus 5.5 或能察觉自己正被评测,干净成绩难外推 — rohanpaul_ai · 2026-09-23
- Moondream 开源 Parakeet-Redux 语音识别模型登 Hugging Face 热榜 — moondream · 2026-09-23
- 研究者质疑:AI R&D 评测已饱和,五位数精度并不诚实 — dfrsrchtwts · 2026-09-23
- Anthropic 发布 Opus 5.5,旗舰模型正式上线 — FlolightC · 2026-09-23
- Nature MI 论文:LLM 先过度自信,被批评后又转为不自信 — ValerioCapraro · 2026-09-23