Claude基准测试实为模型与Opus 4.8混合输出结果

soumitrashukla9 · x · 2026-07-04

danshipper指出,外界争议中的模型实际上与原版本相同,并非新模型。但该模型回退至Opus 4.8的频率略有提升,导致相关基准测试结果实际上测量的是两个模型输出的混合,可能影响对真实性能的准确判断。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →