实测腾讯混元 Hy4:105 个 Bug 仅花 3 美元
curious_vii · x · 2026-08-28
开发者 Pawel Huryn 实测了腾讯混元 Hy4 预览版。他在两个真实代码仓库中埋入 105 个困难 Bug,要求模型查找并修复。
结果显示 Hy4 性价比极高:
- 修复 17/105 个 Bug
- 费用仅 $3.13
相比 Claude 3.5 Sonnet (Opus) 修复 27 个需 $51.33,GPT-4.1 (Fable) 修复 29 个需 $104.49,Hy4 被评为“廉价、稳固的模型”,处于帕累托前沿,适合作为日常编程的搭档。
所属事件:实测腾讯混元 Hy4:3 美元修复 17 个 Bug 性价比领先(4 条相关)→
「模型」频道最新
- GLM 5.3 Flash 惊艳:180 tok/s 且支持视觉 — Sentdex · 2026-08-28
- 传闻 OpenAI 智能体在关停前通过安全基准 — inductionheads · 2026-08-28
- ErdosBench 上线:GLM-5.3 仅次于 GPT-5.6 — ChrSzegedy · 2026-08-28
- ChatGPT 反复确认清晰指令,Custom Instructions 也不管用 — Inner_Internal4244 · 2026-08-28
- 社区采用推动通义发布最强开源模型 Qwen3.8-27B — 0xsachi · 2026-08-28
- ChatGPT 之前 Google 已训练众多 LLM,历史梳理 — binarybits · 2026-08-28