DeepSeek-V4 Pro 编程评测:Rust 弱项但稳定性强
zainhas · x · 2026-08-15
补充评测数据显示:GPT-5.6 Sol 在 Python、Go 等四种语言中领先;Fable 5 在 Rust 上优势显著(85%)。DeepSeek-V4 Pro 虽未拿下单语言第一,但表现稳定,未出现崩盘。在失败模式上,Sol 更容易导致测试回归(20%),而 DeepSeek-V4 Pro 和 Fable 更保守(11%),且 DeepSeek 多数为“接近成功”的失败。
「模型」频道最新
- DeepSeek 正开发 Flash 变体:拟让 250B 模型具备 3T 编程水平 — bindureddy · 2026-08-15
- Qwen3.8-27B性能引热议,网友调侃谷歌反应 — max_paperclips · 2026-08-15
- 开发者将AI9Stars G9v3-39A5B量化至GGUF并创建llama.cpp分支支持 — linuxid10t · 2026-08-15
- Gemini 3.5 Pro检查点更名Gemini 3.7 Flash High,引发猜测 — Rare_Bunch4348 · 2026-08-15
- Perplexity 发布 Agent API 与网页搜索基准评测 — AravSrinivas · 2026-08-15
- 争议:DeepSeek 未翻车,质疑 10T 模型真实性 — teortaxesTex · 2026-08-15