用户实测:Opus 5.5 被高估,编程外仍不及 GPT-6 Astra
haider1 · x · 2026-10-07
博主 haider 称用 Opus 5.5 一周后的观感:确实「说话更好听、看起来更忙」,但常走捷径、做错误假设、活儿粗糙。在编程之外,GPT-6 Astra 在数学、计算机操作、空间推理、3D 建模等方面仍远超 Claude Fable。他认为仅靠编程能力不足以解决科学问题,围绕 Opus 5.5 的热度有些被夸大。
「模型」频道最新
- Hermes Index 完整榜单:头部贵得有理,尾部模型成本仅 5 美分 — NousResearch · 2026-10-07
- Nous Research 推出 Hermes Index 智能体榜单,Claude Opus 5.5 居首 — NousResearch · 2026-10-07
- 实测 Mistral Large 4 玩 FPS:15 万推理 token 仍难玩转 — qtnx_ · 2026-10-07
- Mistral Large 4 翻车频发?网友提醒先确认 reasoning_effort 已开高 — qtnx_ · 2026-10-07
- TypeSafe 发布 Jev 模型:专为软件自动化设计的机器原生智能 — TWIML AI Podcast · 2026-10-07
- Simon Willison 的 llm-mistral 0.16 新增推理模型支持 — Simon Willison · 2026-10-07