Hy3盲测胜出GLM-5.1,前端与CI/CD领域优势显著
eliebakouch · x · 2026-07-06
根据Hy3模型卡披露,该模型组织了270名各领域专家参与盲测,收集312组有效对比,Hy3平均得分2.67/4,高于GLM-5.1的2.51/4。优势在前端开发、CI/CD及数据与存储类任务中最为突出。模型方明确表示不认为公开榜单能反映全貌,因此采用真实工作流测试。
所属事件:腾讯开源混元 Hy3 主打智能体(26 条相关)→
「模型」频道最新
- Moonshot 的 Kimi K3 登上 MathArena 第五名开源最佳 — xeophon · 2026-07-22
- Google 推出 Gemini 3.5 Flash Cyber,限量供政府和可信伙伴使用 — GoogleAI · 2026-07-22
- Kimi K3 在四项公开基准上都领先 Gemini 3.6 Flash — ChrisGPT · 2026-07-22
- Google 停更基础模型超一年,引发外界强烈批评 — teortaxesTex · 2026-07-22
- 当前是 8192 输入、2048 输出,下一步改成 8k/512 — TheZachMueller · 2026-07-22
- Kimi K3 比 K2.7 更慢,但重度编码和长迁移更强 — Far-Presence2711 · 2026-07-22