DeepSeek 被指不擅长后训练?社区反驳:GRPO 与开源编码模型实力不俗
teortaxesTex · x · 2026-08-13
针对“DeepSeek 不擅长后训练”的传闻,有开发者表示反驳,指出其在 2023 年 10 月就推出了最好的开源编码模型,且行业半数都在使用其提出的 GRPO 算法。
原推补充提到,有传言称 DeepSeek 创始人梁文锋不重视智能体方向,甚至有核心成员因此离职。评论则对 DeepSeek 在软件工程(SWE)智能体方面的表现持保留态度,并提及近期版本(0813)出现了一些严重的上下文丢失等翻车问题。
所属事件:社区反驳DeepSeek不擅长后训练传闻(2 条相关)→
「公司和人」频道最新
- Cognition 工程师团队斩获 DEF CON CTF 冠军 — silasalberti · 2026-08-13
- AI 竞赛现状:这是一场必须全程冲刺的马拉松 — peterwildeford · 2026-08-13
- Replit 首次跻身 Inc. 5000 强榜单第 24 名 — amasad · 2026-08-13
- KubeCon 等大会 9 月登陆上海,聚焦 AI 基础设施与智能体 — PyTorch · 2026-08-13
- Paul Graham 谈创业:保持 10% 周增长,去等第二波浪潮 — ycombinator · 2026-08-13
- 深度长文解析:为什么你无法复制 Palantir? — alexeyguzey · 2026-08-13