腾讯混元开源Hy4-preview:770B参数、1M上下文,开源榜约第3
机器之心 · wechat · 2026-08-28
腾讯混元发布并开源新一代大模型Hy4-preview:总参数770B(MoE架构,激活49B),支持1M上下文,Apache 2.0许可开放权重及FP8版本。相比上代Hy3-preview(295B总参/21B激活/256K上下文)容量与上下文均大幅提升。API定价为输入6元/百万tokens、输出18元/百万tokens,缓存命中输入0.3元。
评测方面,Terminal-Bench 2.1从70.8升至85.4,DeepSWE从28.0升至64.3,GPQA Diamond达92.3;在CodeArena:WebDev榜以1633分暂列约第5(AutoEval),开源模型中约排第3。模型定位「为生产力而生」,覆盖软件工程长程任务、多文件办公分析、从一句话生成Unity/Unreal可玩原型、科研等场景;163名内部专家对203个工程任务盲测,平均2.99分(满分4),略高于GLM5.3的2.92与Kimi K3的2.94。
一个亮点是模型首次参与混元自身的训练方法、数据策略、评估与算子优化,在一轮推理基础设施优化中将端到端吞吐较基线提升31.8%。
所属事件:腾讯开源混元 Hy4 Preview:770B MoE、1M 上下文(15 条相关)→
「Infra」频道最新
- 4×3090 实测:Gemma 3.8 27B Q8 比 Next IQ3 82GB 更快也更准 — Repulsive_Initial308 · 2026-08-28
- 清华团队用RTX 5090花$5090从零预训练2B模型,逼近Qwen2.5 — iScienceLuvr · 2026-08-28
- 双 5060 Ti 实测 Qwen 27B:张量并行解码提至 46 tok/s — SellToOpen · 2026-08-28
- Anthropic 拟 70 亿收购芯片厂未果,目标转向 40 亿融资 — DZhang50 · 2026-08-28
- 三张 R9700 32GB 才抵一张 5090:本地玩家纠结换 AMD 阵营 — MrHall · 2026-08-28
- Vulkan 比 CUDA 低温 20 度还快:llama.cpp 后端选择实测心得 — Hot-Employ-3399 · 2026-08-28