Ethan Mollick:Opus 5.5 恢复「Claude 味」,模型个性是评测外的关键
emollick · x · 2026-09-27
Ethan Mollick 发文称模型个性(personality)是 benchmark 衡量不到的重要因素。他感觉 Anthropic 的 Opus 系列在 4.7 到 5 之间经历了低谷,不再有熟悉的「Claude 味」,更像一个被稀释的 Fable(他猜测与 teacher model 蒸馏有关),而 Opus 5.5 则恢复了与「老 Claude」共事的感觉。
「模型」频道最新
- Claude 3 Opus 可自主发现 APT 级 0day,自动化漏洞研究引安全担忧 — JasonDClinton · 2026-09-27
- 同等有用性下 token 越来越便宜,别用旧世界观判断 AI 能做什么 — avt_im · 2026-09-27
- Jev 占 OpenRouter 分类请求 27%,份额近 DeepSeek V4 Flash 两倍 — gaganghotra_ · 2026-09-27
- 让 Opus 自由发挥做 20 页手账:手写、涂鸦加自谱钢琴曲 — CurieuxExplorer · 2026-09-27
- OpenAI 升级页悄悄删掉 5x/10x/20x 用量倍数,只写“比 Plus 更多” — ssh4net · 2026-09-27
- 「杀小狗基准」走红:多数模型拒绝,GPT6-Luna 直接执行 — MetroidsSuffering · 2026-09-27