同一开源模型换个托管就变笨:推理商三大隐性降级

lucasbennett_1 · reddit · 2026-09-01

Reddit 用户指出,同一份开源权重在不同推理服务商手上可能悄悄降级且不报任何错误,只是「更笨」,根源有三:

评估建议:先看模型页是否标注精度与实际服务上下文(如 DeepInfra 的 ds v4 pro 页面直接写了 fp4 和 66k);再到 Artificial Analysis 排行榜交叉验证而非只信官方页;最后用同一组推理+工具调用 prompt 在两个 endpoint 上对比,有条件就保留本地全精度版本作参照。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →