博主:Claude 模型创意文案持续碾压 OpenAI 一年以上
eptwts · x · 2026-10-01
博主 eptwts 观察称,Anthropic 在模型里加入了某种使其在创意工作上明显更强的东西:即使 OpenAI 模型在多数基准测试上领先,“更弱”的 Claude 模型输出的文案与设计仍更好,且这一差距已持续超过一年。他表示不解其背后的原因。
「模型」频道最新
- 爆料称 OpenAI 因安全测试砍掉最强模型,替代品更差却便宜 7 倍 — YvesMulkers · 2026-10-01
- Raschka 深度长文:从 BoW 到 Jev,语言模型分类能力全解析 — neal_lathia · 2026-10-01
- VraserX:别担心基准被榨干,永远会有新 benchmark 可攻 — VraserX · 2026-10-01
- 开源决策模型上云:Beam 推出可试用的 API playground — velobro · 2026-10-01
- 为什么每次模型发布基准分都涨?Reddit 讨论闭源评测的猫腻 — doomadah · 2026-10-01
- Marathoner:9B模型可连续编码10小时+、千次工具调用,SWE-bench达77.5% — mark_k · 2026-10-01