Ornith-1.5-35B-A3B 实测:每秒 250 token
koloved · reddit · 2026-08-21
作者实测了 Ornith-1.5-35B-A3B-NInfer 模型,认为它是目前最好的本地交互模型。响应和推理速度非常快,速度达到每秒 250 token,Prefill 达到 5-8k,且能很好地执行智能体任务。
「模型」频道最新
- DeepSeek 发布 V4 Flash Vision 图像理解 API — aigclink · 2026-08-21
- 商汤开源8B多模态模型U1.5Lite:支持4K输出生图 — 智东西 · 2026-08-21
- 模型榜单同质化:前 12 名中 9 个竟是同一个 — Beamsters · 2026-08-21
- 实测 Sol 优于 Fable:自主能力更强且消耗更少 — vinis_artstreaks · 2026-08-21
- DeepSeek 策略转向:单项对标 Opus-4.8 而非全能比拼 — eyishazyer · 2026-08-21
- Indic-Translate 发布:支持 22 种印度语言的 32K 上下文翻译 — prajdabre · 2026-08-21