Anthropic 被指发布误导性评测数据,遭开发者质疑
soumitrashukla9 · x · 2026-07-30
针对 Anthropic 此前发布的“胜利”推文,有开发者引用讨论指出,其公布的评测数据看起来极其荒谬。他质疑 Anthropic 内部在发布前为何没有停下来核实这些明显异常的数字,批评该公司在模型性能宣传上不够严谨。
「模型」频道最新
- ThursdAI直播预告:探讨1.56TB的Kimi K3检查点 — altryne · 2026-07-30
- Kimi K3 递归自我改进 Cline,终端基准得分升至 88.8% — teortaxesTex · 2026-07-30
- 开发者痛批AI圈“造假”演示:Claude Opus神级表现实为夸大 — wavefnx · 2026-07-30
- OpenRouter 数据:Together 提供 Kimi K3 最低价与最高缓存命中率 — zhyncs42 · 2026-07-30
- 微软向华尔街展露野心:自研模型与工具全面对标 OpenAI — TechCrunch AI · 2026-07-30
- GPT-5.6 Sol 推理测试细节:缺乏记忆导致模型每步需重新理解规则 — charliermarsh · 2026-07-30