V4.1 创意游戏中「碾压」对手,网友盛赞 DeepSeek RL 路线
teortaxesTex · x · 2026-09-09
博主 teortaxesTex 称对 DeepSeek V4.1 感到惊叹,不在意跑分,认为这完全验证了 DeepSeek 的 RL 研究路线——有 R1-Zero 式的 agentic 时代能量:模型在创意游戏设计中像孩子一样自由发挥,没有恐惧、恶意或明显的「对齐」痕迹,并建议团队无视竞争对手、继续扩大这种方法的规模。后续帖子里他补充观察到 V4.1(Neowhale)在创意游戏设计环节压制了另一个模型 Astra。
「模型」频道最新
- Blender 同题实测:两旗舰模型输出差距悬殊,训练数据分布是主因 — ZeroStateReflex · 2026-09-09
- Netlify 上线 GPT-6 Astra 等 3 款新模型,Agent Runner 智能改配额用法 — thisiskp_ · 2026-09-09
- GLM-5.3-Flash 登顶智能体工具调用榜首,输出仅 $0.50/百万 token — shensi · 2026-09-09
- Artificial Analysis 四天两次调榜,Astra 真实实力获认可 — py-net · 2026-09-09
- Gary Marcus 断言:真正的能力在 harness 而非模型,企业 beware 黑箱 — GaryMarcus · 2026-09-09
- Inception 发布 Mercury 2.5:最强扩散 LLM,1107 tokens/秒、26 万上下文 — StefanoErmon · 2026-09-09