实测:中美 AI 模型差距在生产中已无意义

Any-Ad7702 · reddit · 2026-08-29

作者分享其实测经验:今年主要使用 DeepSeek、Qwen、GLM 等中国模型,Claude 仅作为兜底。本周试用的 Hy3 模型(21B 激活参数)在编码和 API 集成任务上,表现接近 DeepSeek V3 和 Kimi K3。作者认为,鉴于 DeepSeek 在 OpenRouter 上的统治地位、Qwen 在 Arena-Hard 的领先,以及小模型如 Hy3 的强劲表现,OpenAI 和 Anthropic 的护城河在实际生产任务中已不明显。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →