打破「DeepSeek 不擅长后训练」迷思
teortaxesTex · x · 2026-08-13
针对近期流传的「DeepSeek 不擅长后训练」的说法,作者列举事实予以反驳。他指出,DeepSeek 早在 2023 年 10 月就发布了当时最强的开源编程模型,其提出的 GRPO 算法被业界广泛采用,在 CF/CritPt 上的 Speciale 也是一项重大的开源突破。作者猜测,这种偏见可能仅仅源于「梁文锋不懂 SWE agents」的毫无根据的传言。
所属事件:社区反驳DeepSeek不擅长后训练传闻(2 条相关)→
「模型」频道最新
- 用 Grok 4.6 搭建《办公室》智能体模拟,实测速度与能力大升级 — mattyp · 2026-08-13
- Sakana AI 更新 Chat:新增 Fugu 模型并支持代码执行 — SakanaAILabs · 2026-08-13
- 开发者实测 Gemini V4-Pro:表现不及预期,疑似受蒸馏影响 — teortaxesTex · 2026-08-13
- DeepSeek V4-Pro 评测升至开源第二,被指仅靠 pass@2 刷分 — teortaxesTex · 2026-08-13
- 本地部署 DeepSeek V4 Flash:双 DGX Spark 体验极佳 — andrewchen · 2026-08-13
- DeepSeek v4-pro 评测:极低成本比肩 Opus,日常体验差异微乎其微 — haider1 · 2026-08-13