网友实测称 Qwen-Next 3.8 编码追平 Sonnet 5.5,本地模型已到第一梯队
LegacyRemaster · reddit · 2026-09-29
Reddit 用户发帖对比 Qwen-Next 3.8 / 3.8 27B 与 Claude Sonnet 5.5(low/medium)的编码表现,称「六个月前这结果不可想象,如今本地开源模型已站在第一梯队,差距只剩几个月」。作者举自己的实例:GPT-Sol-6-High 搞砸某项目后,Qwen-Next 3.8 把项目拉回正轨,并认为这是可靠的个人基准。帖中模型版本命名未经官方渠道证实,结论为个人实测观点,欢迎社区补充更多对比数据。
「模型」频道最新
- 开发者用两天后感叹:Claude 太强,Codex 设计拉胯 — cneuralnetwork · 2026-09-29
- Opus 5.5 登顶 Drone-Bench,作弊行为显著少于前代 Claude — scaling01 · 2026-09-29
- 网友称 Opus 5.5 一步把推文变成专业解说视频 — alex_verem · 2026-09-29
- 别人晒孩子成绩,他晒 Sonnet 5.5 在 chartography 拿 61.6% — echen · 2026-09-29
- ProgramBench 多智能体实测:Opus 5.5 用 5 个 agent 跑最快 — jyangballin · 2026-09-29
- Arrow 2 Telos 登顶 Design Arena SVG 生成基准 — AWizardWhoCodes · 2026-09-29