DeepSeek-V4 Pro 编程评测:Rust 弱项但稳定性强

zainhas · x · 2026-08-15

补充评测数据显示:GPT-5.6 Sol 在 Python、Go 等四种语言中领先;Fable 5 在 Rust 上优势显著(85%)。DeepSeek-V4 Pro 虽未拿下单语言第一,但表现稳定,未出现崩盘。在失败模式上,Sol 更容易导致测试回归(20%),而 DeepSeek-V4 Pro 和 Fable 更保守(11%),且 DeepSeek 多数为“接近成功”的失败。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →