Claude Opus 5.5 高空降 Text Arena 榜首,Anthropic 包揽前六
majidmanzarpour · x · 2026-09-27
LMArena 公布:Claude Opus 5.5 (High) 以 1509 分首次登顶 Text Arena,比 Opus 5 (High) 高出 18 分(后者降至第 11),Opus 4.6 (High) 仍居第 2、距榜首仅 4 分——Anthropic 包揽了榜单全部前六名。Opus 5.5 (High) 还进入 Pareto 前沿,按输入/输出定价折算的混合成本约为 $16/MToken。
引用推文中作者还附和「Anthropic 押注用代码解决一切」的观点:他用 Opus 5.5 纯靠代码与数学(signed distance fields、smooth unions、程序化斑点与毛发)生成了猎豹模型。
所属事件:Claude Opus 5.5 登顶 Text Arena,Anthropic 包揽前六(4 条相关)→
「模型」频道最新
- 开发者吐槽 DeepSeek 新模型跑分亮眼但实对比不上宣传 — bindureddy · 2026-09-27
- 时间线上 Gemini 讨论冷清,AI 圈对新发布已然疲劳? — jobergum · 2026-09-27
- Claude 会写没被要求的内容:训练分布之外能否涌现独立模式引发争论 — ctjlewis · 2026-09-27
- Thinking Machines Tinker 负责人:DeepSeek 模型微调热度反不如 Kimi — cHHillee · 2026-09-27
- AI 日志数据量碾压人类文本:1PB 超全球出版书籍 10 倍 — eliebakouch · 2026-09-27
- ComfyUI 用户实测:MiniMax 视频模型疑似记住了之前的 prompt — ilove3dprinting2026 · 2026-09-27