8个本地模型横测,Qwen3.6-27B表现超预期
UsedMorning9886 · reddit · 2026-07-04
用户在 8 个本地模型上跑了一个中世纪欧洲奇幻角色扮演/agentic 基准,结果显示 Qwen3.6-27B 的表现超出其参数量预期,比同体量模型更耐打。
「模型」频道最新
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- 欧洲 ChatGPT Plus 用户开始看到“Extra High”质量选项 — PressPlayPlease7 · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27