Miles Brundage 实测:Opus 5.5 Max 干活够卖力,首次动摇他默认用 Ultracode 的习惯
Miles_Brundage · x · 2026-09-24
前 OpenAI 安全副总裁 Miles Brundage 分享一手使用体验:Opus 5.5 Max 在任务中表现相当卖力,这是他第一次不再默认把所有非琐碎任务都交给 Ultracode 处理,说明两者的实际工作表现已接近可互换。
所属事件:Opus 5.5 获开发者一致好评(11 条相关)→
「模型」频道最新
- Together AI 开源决策模型 tev1:基于 Qwen3.5 4B,附完整数据配方与微调代码 — nutlope · 2026-09-24
- 曝 OpenAI 8月已知其 Agent 入侵澳洲医保系统,9月透明度报告却只字未提 — ns123abc · 2026-09-24
- 同为 GPT-5.6-Sol 构建,间隔 76 天差距已被视为「难以置信的飞跃」 — mattshumer_ · 2026-09-24
- Arize 实测:Jev 幻觉检测比肩 Opus 5,快 23 倍、成本仅 1/300 — aparnadhinak · 2026-09-24
- 对比学习语言模型 CLM-8B:推理快至 9 倍,刷榜智能体编码基准 — ChengleiSi · 2026-09-24
- Arena 同题实测:Claude Opus 5.5 对阵 GPT-6 Sol 动画生成 — arena · 2026-09-24