用户实测称 DeepSeek 新模型「优于当前其他所有模型」
0xSero · x · 2026-09-18
网友 0xSero 表示自己正在把 DeepSeek 新模型用于安全研究、机器学习、浏览器操作、computer use、聊天和绘画等各类任务,称「目前更喜欢它胜过任何其他模型」。回复者则指出从 Benchmark Heaven 的数据看,该模型可能有点「刷榜」(benchmaxxed),榜单分数与真实 held-out 表现或存在差距。
「模型」频道最新
- Figure 人形机器人进 30 个陌生家庭,零重训直接干活 — minchoi · 2026-09-18
- ThursdAI 周报:TypeSafe 发布 Jev 决策模型,延迟 70-500ms 且输出免费 — thursdai_pod · 2026-09-18
- TypeSafe 创始人:给机器代码套人壳,别再造洗碗机器人 — thursdai_pod · 2026-09-18
- 非 LLM 模型 Jev 亮相:不写答案,直接返回概率 — thursdai_pod · 2026-09-18
- GPT-6 Astra 已通关最难 Geometry Dash 关卡的 70% — imjustnewatai · 2026-09-18
- 早期试用者断言 Jev 将比想象中更具颠覆性:快到软件能预判你的输入 — hardimanjames · 2026-09-18