DeepSeek V4-Flash 性能暴涨,或因 V4-Pro 充当 RL 教师

teortaxesTex · x · 2026-07-31

针对 DeepSeek V4-Flash 性能大幅提升的现象,有观点推测 DeepSeek 可能基于更强大的 V4-Pro 模型创建了强化学习(RL)教师模型,从而带动了 Flash 版本的性能飞跃。

不过,社区对于 V4-Pro 基座模型的质量及其能力上限仍存在疑虑,并期待其正式版能有更惊艳的表现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →