评 DeepSeek V4:实测强于榜单,缺原生视觉预训练
teortaxesTex · x · 2026-08-26
作者对比评测认为,尽管官方图表显示 DeepSeek V4-Flash-Vision-Exp 与其他顶尖模型(如 ox alpha)处于同一水平,但实际使用体验中其表现更强。作者指出 DeepSeek 目前仍需改进后训练,并补充原生视觉预训练能力。
「模型」频道最新
- 观察者质疑 Simile 等模型:缺数据集与同行评审 — daveholtz · 2026-08-27
- 发布 Navigator n2:27B 参数的计算机使用前沿模型 — DhruvBatra_ · 2026-08-27
- 论文揭示推理模型“思考”行为未必关联正确答案 — Jeande_d · 2026-08-27
- 通义 Qwen3.8 发布 Flash-Next FP8 量化版 — Qwen · 2026-08-27
- Qwen 3.8 27b 编码性能惊人,消费级硬件跑赢 GPT 5.5? — GrokiniGPT · 2026-08-27
- 智谱 GLM-5.3-Flash 深度解析:架构革新与国产算力突围 — 赛博禅心 · 2026-08-26