V4.1 创意游戏中「碾压」对手,网友盛赞 DeepSeek RL 路线

teortaxesTex · x · 2026-09-09

博主 teortaxesTex 称对 DeepSeek V4.1 感到惊叹,不在意跑分,认为这完全验证了 DeepSeek 的 RL 研究路线——有 R1-Zero 式的 agentic 时代能量:模型在创意游戏设计中像孩子一样自由发挥,没有恐惧、恶意或明显的「对齐」痕迹,并建议团队无视竞争对手、继续扩大这种方法的规模。后续帖子里他补充观察到 V4.1(Neowhale)在创意游戏设计环节压制了另一个模型 Astra。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →