DeepSeek 下一代模型被指应先补上持续学习
teortaxesTex · x · 2026-07-23
这条讨论认为,DeepSeek 的下一代模型关键能力应是持续学习。作者指出,这一点既能从 V4 论文里看出来,也能从招聘方向里看出来。
回复里还提到,V4 还应该具备原生多模态。另有人补充说,V4 可能已经是团队当前能训练到的最大规模,因此在迈向更大突破前,DeepSeek 可能会先继续做“性价比”优化。
所属事件:DeepSeek 谈研发路线:算法降本、持续学习与克制文化(5 条相关)→
「模型」频道最新
- Kimi K3 以 19.37 美元找出 86 个漏洞中的 32 个 — zeeg · 2026-07-23
- 有人调侃 K3 其实是蒸馏出来的“美国模型” — iamtrask · 2026-07-23
- SolarOpen2 权重已公开,可自由使用和微调 — algo_diver · 2026-07-23
- 一条帖称 Opus 5 今天发布,市场或迎来重置 — dejavucoder · 2026-07-23
- Kimi K3 可能已经成了某团队的代码审查模型 — zeeg · 2026-07-23
- Teortaxes:国内高质量数据标注只在半年内才真正起步 — zephyr_z9 · 2026-07-23