讨论:为何 Claude Opus 5 的指令遵循得分显著低于其他模型?
GloriousLebron · reddit · 2026-08-25
用户展示了一张模型评测对比图,指出 Claude Opus 5 在“指令遵循”指标上的得分明显低于其他模型,引发疑问。
「模型」频道最新
- Arav Srinivas:端侧模型处理敏感文档至关重要,OCR 性能达 SOTA — AravSrinivas · 2026-08-25
- 模型 checkpoint 比较必须与测试 harness 绑定 — jmpenni87 · 2026-08-25
- 路透:四大西方实验室及中国 AI 厂商未来半年模型展望 — Justgototheeffinmoon · 2026-08-25
- Anthropic 模型疑似大幅降价:Sonnet 降至 5 美元 — scaling01 · 2026-08-25
- 新架构模型上下文窗口大幅超越 Transformer — thesaraharminta · 2026-08-25
- MiniMax H3用户实测:1MP画质反而不如0.7MP真实 — dominic__612 · 2026-08-25