Qwen 3.6-35B GGUF 编码测试,Hermes 2 夺得 29.8 分
moahmo88 · reddit · 2026-07-27
这条帖子给出了一组 Qwen 3.6-35B GGUF 变体的编码能力对比测试,覆盖 3 个题目:
- Kadane 最大子数组和
- Python 平均值 bug 修复
- 用 Redis 设计限流 REST API,并给出 FastAPI 实现
图里的最终榜单显示:
- Hermes 2:29.8/30,拿到第 1 名
- Hermes:29.5/30
- KwaiPilot:28.0/30
- 35B:27.5/30
- Ornith-35B:22.0/30
测试是在 RTX 5070 Ti 16GB + 32GB RAM 上完成,并用开启 thinking 的 Gemini 3.6 Flash 评分。
「编程与Agent」频道最新
- 只靠提示词,做出 Trevor Noah 书页特效复刻版 — xiaohu · 2026-07-27
- 435 篇论文综述:LLM agent 的回滚、审计和恢复严重不足 — rohanpaul_ai · 2026-07-27
- 一个财务 agent 已能读账,下一步是放开支付 — 3lonStarl1nk · 2026-07-27
- AI Shipping Labs 公开 10 场 workshop 代码,覆盖 agent 部署与向量检索 — Al_Grigor · 2026-07-27
- Observer 用本地模型监控屏幕麦克风并自动告警 — alex_verem · 2026-07-27
- Agent 编排该用 Loop 还是 Graph — alex_verem · 2026-07-27