DeepSeek研究员披露路线:直攻测试时参数级持续学习
DeepSeek 研究员胡声鼎公开一段高度具体的技术路线宣言:不做递归自我改进(RSI),也不做 harness 层面的演化,而是直接攻克测试时的参数化持续学习。博主 teortaxesTex 解读称,DeepSeek 自 V3 之后的目标是「无限上下文」,已将 KV 缓存压缩至每 token 890 字节,使 100 万上下文接近线性成本,并配合 RL 推进该方向。
2026-09-13 ~ 2026-09-13 · 2 条相关
- DeepSeek 研究员胡声鼎表态:直取测试时参数级持续学习路线 — teortaxesTex · 2026-09-13
- DeepSeek 研究员透露方向:直攻测试时参数化持续学习 — teortaxesTex · 2026-09-13