35B级别开源模型横评:Ornith与Qwen3.6表现优于Laguna
S_Anv · reddit · 2026-08-03
作者对三款开源大模型进行了横向能力测试,包括 Ornith 35B、Qwen 3.6 35B (A3B) 和 Laguna S 2.1 122B。
测试基于原生 llama.cpp 环境进行单次提问对比,结果显示:
- Ornith 35B (Q8 K XL 量化) 表现最佳。
- Qwen 3.6 35B 紧随其后。
- Laguna S 2.1 表现令人意外,作者认为其遭遇了明显失败。
所有测试的提示词和实时输出记录均已公开,供社区查阅。
「模型」频道最新
- Gary Marcus:OpenAI 新模型 Astra 被严重高估,数学突破不等于 AGI — Gary Marcus · 2026-08-03
- KOL 称仅 OpenAI 真正掌握推理技术,DeepSeek 靠中等算力登顶评测 — teortaxesTex · 2026-08-03
- Gemini视频生成惹众怒:付费Pro用户额度竟比免费版还少 — Captain-Thump · 2026-08-03
- 翻车名场面:Google Gemini 连简单的数数任务都搞砸 — polo421 · 2026-08-03
- 实测百个Bug:如何将AI编程月费从200降至20美元 — PawelHuryn · 2026-08-03
- 非技术人员AI编程指南:20美元月费完胜200美元方案 — PawelHuryn · 2026-08-03