实测对比:腾讯 Hy4 预览版研究能力显著优于 Hy3
ShunyuYao12 · x · 2026-08-28
开发者在相同研究任务下对比了腾讯混元 Hy3 和 Hy4 预览版的表现。结果显示:
- Hy3:完成了研究任务,但输出需要更多打磨。
- Hy4:对源材料的处理更好,能在整个工作流中保持上下文,更清晰地连接研究发现,并提供了更强有力的最终研究输出。
测试者认为,研究能力的提升是 Hy4 最显著的进步。
「模型」频道最新
- GLM 5.3 开源权重亮相,DFlash 2 投机解码吞吐达 FP8 的 4.4 倍 — gan_chuang · 2026-08-29
- 国产模型“寒武纪大爆发”?网友热议背后推手 — vista8 · 2026-08-29
- Claude 与 Gemini 语义通过率均达 98.67%,失败机制却不同 — Plastic-Cell-4497 · 2026-08-28
- 本地推理工具 ds4 新增分支,支持 GLM 5.3 Flash — lakySK · 2026-08-28
- Gemini 1.5 Flash 推理速度实测或超 300 tok/s — Sentdex · 2026-08-28
- 谷歌开源 TimesFM:零样本预测销售与股价走势 — mdancho84 · 2026-08-28