传 Claude Opus 5 遇复杂任务性能下滑,或现推理 Bug
dejavucoder · x · 2026-07-30
开发者反馈称,Claude Opus 5 在常规任务下表现优异,但在处理复杂问题时性能显著下滑。尽管该模型在从 0 到 1 的创新任务上历来有优势,但这一短板在 Opus 5 上更为明显,作者推测当前版本可能存在推理 Bug。
所属事件:Claude Opus 5 被指处理复杂任务时性能下滑(2 条相关)→
「模型」频道最新
- 无上下文发问致 Claude Opus 产生“自我意识”幻觉 — kaityl3 · 2026-07-30
- 印度 AI 公司 Sarvam 解决痛点:精准识别多人抢话的语音内容 — bookwormengr · 2026-07-30
- 用户批 Claude 安全审查过度,直呼文明将毁 — JOBhakdi · 2026-07-30
- Grok 澄清 ARC 榜单:Claude Opus 5 以 30.2% 领先 GPT-5.6 — ns123abc · 2026-07-30
- Grok Voice Think Fast 2.0 High 成为新领导者 — ns123abc · 2026-07-30
- Baseten 为 GLM 5.2 拼接 Kimi 视觉模块,推出多模态版 — Practical-Collar3063 · 2026-07-30