初测称 Claude Opus 表现糟糕,Grok 4.5 更占上风
JOBhakdi · x · 2026-07-25
作者表示,自己对 Claude Opus 做了内容、思考和策略方面的初测,体验非常糟糕:语言粗糙、推理不优雅、经常抓不住重点。帖子还直接下判断说它明显不如 SOL,并认为 Grok 4.5 目前更占上风。
「模型」频道最新
- giffmana 补充:环境用于训练正是他要说的重点 — giffmana · 2026-09-11
- 开源 LLM 排行榜与定价对照目录,一站式索引比较工具 — Last_Establishment_1 · 2026-09-11
- Anthropic 称已尽力让评测环境不可被模型识别 — MaxKannen · 2026-09-11
- Nex N2.5 Pro 开源发布,权重体积达 407GB — jinnyjuice · 2026-09-11
- RoMa v2 图像匹配模型发布,作者晒出黑底宣传图 — ducha_aiki · 2026-09-11
- OpenAI 称 Astra 达 Critical 网络安全阈值,且比上代更难监控 — theguywhobuilds · 2026-09-11