DeepSeek 研究员透露方向:直攻测试时参数化持续学习
teortaxesTex · x · 2026-09-13
博主 teortaxesTex 解读 DeepSeek 的路线:自 V3 后目标是「无限上下文」,已把 KV 压到每 token 890 字节、1M 上下文接近线性成本,配合 RLM 与 harness 技巧可扩展到数百万 token。同时转发 DeepSeek 成员 Shengding Hu 的明确表态——「不做 RSI、不做 harness 级进化,直攻测试时参数化持续学习(疑似类似 SSI)」,并招募符合条件的合作者。
所属事件:DeepSeek研究员披露路线:直攻测试时参数级持续学习(2 条相关)→
「模型」频道最新
- 网友指 DeepSeek V4.1 Flash 疑似被公开 benchmark 污染 — teortaxesTex · 2026-09-13
- Overnight 基准测试 45% rollout 中途失败,开发者吐槽 OpenAI 容量吃紧 — dejavucoder · 2026-09-13
- 用 Gemini 翻译 swarm 语言与英文互译,效果出奇地好 — xeophon · 2026-09-13
- 「都说 AGI 来了,Fable 和 Astra 内部模型为何还是那么贵?」 — SaW120 · 2026-09-13
- DeepSeek V4.1 服务成本更低但定价翻倍,毛利率或显著走高 — teortaxesTex · 2026-09-13
- 用户从 Claude Code 转 Codex:历史迁移、插件与 skill 均成难题 — Inevitable2727 · 2026-09-13