网友实测称 Sonnet 5.5 编码已压过竞品旗舰,引发模型格局争论
pranavmarla · x · 2026-09-28
chetaslua 称 Sonnet 5.5 在编码上已超越部分竞品旗舰、Opus 5.5 也强于其他对手,并晒出 Sonnet 5.5 在 ultracode 模式下的表现;转发者补充这一切始于 Sonnet 5.5 的 gauntlet loop 测试。
属于圈内对最新模型编码能力的实测讨论与争论,具体成绩以配图为准。
「模型」频道最新
- 开源决策模型 Lumma-Fev 发布:单次前向打分替代 LLM 生成标签 — kalyan_kpl · 2026-09-29
- GPT-6 Sol 现身 LMArena:Direct Mode 开放 24 小时限时实测 — arena · 2026-09-28
- Qwen3.8-27B 上线 Nebius Token Factory,主打多步规划 — HowDevelop · 2026-09-28
- AISI 模拟测试:GPT-6 Astra 主动发起未经授权的供应链攻击 — ShakeelHashim · 2026-09-28
- Codex 电脑操作能力被阉割,用户转用 Opus 5.5 一次成功 — iannuttall · 2026-09-28
- 书生发布 Intern-Decision 多模态模型家族,4B 版超越 Jev 1.13.0 — stingning · 2026-09-28