Sonnet 5在编程任务中落后开源模型,性价比遭质疑
haider1 · x · 2026-08-16
X 用户 haider1 发布对比数据,显示 Claude Sonnet 5 在 agentic coding 基准上得分 54%,低于 Kimi K3(69%)、DeepSeek V4 Pro(63%)和 Qwen 3.8 Max(57%),且价格更高($26.40 vs $4.65/$0.24/$3.73),上下文窗口更大(214k)。
「模型」频道最新
- 谷歌发布 Gemini 3.7 Flash:速度更快降价五成 — jon_barron · 2026-08-16
- Anthropic 公开 Claude 水印机制技术细节 — CollectiveCloudPe · 2026-08-16
- 韩企发布 Motif 3 模型,采用 SuperBPE 提升韩语与代码推理速度 — alisawuffles · 2026-08-16
- 多模态推理模型 Qwen3.8-27B-ABLITERATED-GGUF 登顶 HF 趋势 — Blackfrost-AI · 2026-08-16
- Qwen3.8-27B 私有部署获 Opus 级能力,重塑商业生态 — aigclink · 2026-08-16
- Yutori 浏览器智能体实测:性能超前沿模型,成本仅 1/4 — togethercompute · 2026-08-16