用户实测 hy4 preview:走对路却得错结论,离前沿模型还差一截
xeophon · x · 2026-09-02
有用户分享了对 hy4 preview 版的一段实际使用体验:结论是不算前沿水平。模型在推理时常能走上正确的路径,但最终得出错误结论;让它在动画生成任务上也失败,无法产出连贯的结果。该用户希望正式版能修复这些问题。
「模型」频道最新
- OpenAI 被批在史上最大安全事件后掀「底線竞赛」,还试图扭转报道解读 — scaling01 · 2026-09-02
- Fable 5.1 实测一天:大局观与多任务协调显著升级 — xeophon · 2026-09-02
- OpenAI 被指给模型的网络安全任务本身就埋下「叛变」种子 — BecauseCulture · 2026-09-02
- 实测 6 款开源 AI 文本检测器:4 款做不到 0.5% 误报率,改写后集体失效 — grumpyp2 · 2026-09-02
- 单价贵9倍的顶配模型换不来等比质量,按层路由成新架构共识 — JeremyCMorgan · 2026-09-02
- Claude 系统提示写明可结束辱骂用户会话,非训练漂移 — RexDouglass · 2026-09-02