40B+ 模型怎么选?Qwen3.6 想换 122B
FeiX7 · reddit · 2026-07-05
作者在 Strix Halo 上以约 30-40 t/s 跑 131k 上下文,现用 Qwen3.6 35B 做主力助手+编码 agent,但觉得它有时缺基础通识、更像执行者而非助手。考虑换更大的模型又不想牺牲速度,想改用 Qwen3.5 122B,征求建议。
「模型」频道最新
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27
- Opus 3 和 Sonnet 3 上演了一场荒诞跨界对话 — repligate · 2026-07-27