用户指责 Anthropic 评测数据造假,实际体验缩水

GabGarrett · x · 2026-08-12

有用户在社交媒体上批评 Anthropic 自 4.7 版本以来的模型存在评测数据与实际服务严重脱节的问题。该用户指出,公司发布的公开评测成绩可能是经过“修饰”的,并不能反映真实客户体验。

此外,该用户还声称,自 4.8 版本起,Anthropic 拒绝在公共 API 上进行任何基准测试,这一举动进一步加剧了外界对其模型真实能力的质疑。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →