DeepSeek V4-Pro实测曝光推理强度与控制问题
博主karminski3对DeepSeek-V4-Pro-0813进行实测,发布视频探讨模型性能。测试发现推理强度max模式表现不如high甚至v4-flash,且模型存在停止控制问题。经18次独立长程测试及1亿token验证,证实该问题独立于脚手架,且换提示词无效。
2026-08-16 ~ 2026-08-16 · 2 条相关
- DeepSeek V4-Pro实测:推理强度max不如high?Harness能否拯救? — karminski3 · 2026-08-16
- DeepSeek V4-Pro停止控制问题独立于脚手架,1亿token测试证实换提示词无效 — karminski3 · 2026-08-16