DeepSeek V4F-0731 在 EQ-Bench v4 成绩平平,高强度 RL 或损伤模型个性?

xeophon · x · 2026-08-01

TNG 科技对 DeepSeek 的 V4F-0731 模型在最新的 EQ-Bench v4 基准测试中的表现进行了测算,发现其成绩仅处于中等水平。

这引发了关于模型训练方法的探讨:高强度强化学习(RL)是否会对模型的「个性」产生负面影响?这种过度对齐或训练可能会在特定维度的测试中削弱模型原本的表现力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →