GLM 5.3 Flash 对比 DeepSeek V4.1:体素场景实测打平

teortaxesTex · x · 2026-09-08

用户在相同条件下用两个模型生成体素立体模型(voxel diorama)并对比耗时:GLM 5.3 Flash 与 DeepSeek V4.1 完成时间相近。DeepSeek 在录制视频时出现雾效和距离问题,但作者认为其底层模型质量更好,综合判断两者大致持平。

细节:V4.1 用了约 1.5 倍步数(150 步),输入 2500 万 token、输出 21.5 万;V4-Flash-Vision-Exp 输入 920 万 token、输出 11.9 万。两个模型都自行产出了视频,另有 V4.1 的一次运行(输入 1200 万、输出 16.8 万)正在处理中。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →