实测腾讯混元 Hy4:执行能力跻身开源模型第一梯队

HeyAmit_ · x · 2026-08-30

作者在 WorkBuddyAI 中测试了腾讯混元 Hy4 preview 模型。该模型总参数 770B,激活参数 49B,支持 100 万 token 上下文。测试发现其最大亮点在于执行而非回答质量:能够拆解任务、跨工具工作、处理长上下文、编写代码并自我验证。在腾讯 203 个工程任务的盲测中,Hy4 预览版得分 2.99/4,超过 GLM 5.3 和 Kimi K3。作者认为其体验更接近 Agent 而非聊天机器人。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →