DeepSeek 被指不擅长后训练?社区反驳:GRPO 与开源编码模型实力不俗

teortaxesTex · x · 2026-08-13

针对“DeepSeek 不擅长后训练”的传闻,有开发者表示反驳,指出其在 2023 年 10 月就推出了最好的开源编码模型,且行业半数都在使用其提出的 GRPO 算法。

原推补充提到,有传言称 DeepSeek 创始人梁文锋不重视智能体方向,甚至有核心成员因此离职。评论则对 DeepSeek 在软件工程(SWE)智能体方面的表现持保留态度,并提及近期版本(0813)出现了一些严重的上下文丢失等翻车问题。

所属事件:社区反驳DeepSeek不擅长后训练传闻(2 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →