专题 · FULL STORY
Ornith-1.5 发布:开源新秀冲击顶级模型
8月19日开源模型家族 Ornith-1.5 正式发布,提供 9B Dense、35B MoE 与 397B MoE 三种 MIT 协议开源配置,其中 397B 版对标 Claude Opus 4.8。随后数日内其 9B 版本热度攀升,登顶 Hugging Face 趋势榜,成为社区关注焦点。
2026-08-19 ~ 2026-08-21 · 2 集 · 26 条
第 1 集 · 开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus 4.8(2026-08-19,24 条)
8 月 19 日,开源模型家族 Ornith-1.5 正式发布,包含 9B Dense、35B MoE 与 397B MoE 三种配置,采用 MIT 协议开源,覆盖从端侧到大规模部署的不同推理需求。据 @testingcatalog,发布方为 DeepReinforce;@alexcovoeth 转述其为美国团队,@Fun-Meaning-6474 提到发布主体亦称 Ornith Lab,并补充 9B 密集版具备视觉能力。旗舰 397B 版在 Terminal-Bench 2.1 上得分 86.1,官方称整体性能在推理、Agent 与编程任务上比肩 Claude Opus 4.8;据 @rohanpaulai 转述口径,397B 版在多项基准上与 Claude Opus 4.8 相当。目前这些成绩均来自发布方自评,尚无独立第三方复现验证。
已确认
- 模型规格与 MIT 许可为官方信息,由 @tarruda 首先发布;@KokaOP 同日给出家族概览,@testingcatalog 补充发布方名称 DeepReinforce。
- @KokaOP、@testingcatalog 等多条帖子均给出 397B 版在 Terminal-Bench 2.1 得分 86.1 的具体成绩,另有 SWE-bench 等基准成绩展示。
- 据 @ornith-ai,Ornith-1.5-35B-A3B 发布次日即在 Hugging Face 趋势榜热度上升,该版本为多模态对话模型,采用 Qwen2.5-MoE 架构,支持图像文本到文本生成,MIT 许可。
- 据 @ollama 转发,Ornith-1.5 全系三种尺寸已上线 Ollama,个人用户可便捷本地部署。
- 核心技术亮点是端到端自我改进训练策略:据 @aftahiai 等转述,模型能自主提出新任务、生成特定脚手架并产出强化学习解决方案,持续为自己创建学习经验,而非被动完成任务。
- @Shruti0810 补充称 9B 版在多个基准测试中可与更大模型竞争,且 MIT 协议对商用友好。
- 据 @Fun-Meaning-6474,AtomicChat 团队已在发布次日(8 月 20 日)推出针对 9B 密集版与 35B-A3B MoE 版的量化版本及评测。
- 据 @alejandroll10 转述,35B MoE 版在推理、编码与智能体基准上超越同量级的 Qwen 3.6-35B,每 Token 仅激活 3B 参数,仍优于密集模型 Gemma 4-31B 与 Meta 的 Muse 系列(此为转发口径,未见原始评测佐证)。
尚未确认
- 「媲美 Claude Opus 4.8」等结论目前主要来自发布方自己的评测与宣传,尚缺独立第三方复现验证;@iamfakhrealam、@aftahiai、@Teknium 等多条转发均重复同一口径,未见新增独立证据。
- @aftahiai 转发中提到的「对标 GPT-4.5」无具体数据支撑;@alexcovoeth 转发的演示视频显示 9B 模型可在断网环境下运行完整智能体,属转述口径,暂无一手评测佐证。
为什么重要
- 端到端自我改进(模型自己生成学习任务与脚手架)是区别于常规后训练的新范式,若复现成立,可能降低对人工构造训练数据的依赖。
- MIT 协议加上从 9B 到 397B MoE 的完整规格覆盖,让个人开发者到大型部署方都能取用;35B-A3B 登上 Hugging Face 趋势榜、全系上线 Ollama、AtomicChat 量化版在发布次日即出现,说明社区生态快速跟进,是开源阵营对闭源顶配模型的一次直接对标。
- 新模型 Ornith 1.5 发布:9B 密集版与 35B/397B MoE 版 — tarruda · 2026-08-19
- 开源模型 Ornith-1.5 登场,推理编程直逼 Claude Opus — aftahi_ai · 2026-08-19
- MIT许可开源模型Ornith-1.5发布:自称可媲美Claude Opus — iamfakhrealam · 2026-08-19
- 对标 GPT-4.5?开源模型 Ornith-1.5 自我改进刷榜 — aftahi_ai · 2026-08-19
- Ornith-1.5 发布:端到端自改进模型,性能匹敌 Claude Opus — rohanpaul_ai · 2026-08-19
- 对标 Claude Opus,开源模型 Ornith-1.5 展示自我改进新范式 — aftahi_ai · 2026-08-19
- Ornith-1.5 发布:自进化 MoE 架构对标 Claude Opus — aftahi_ai · 2026-08-19
- Ornith-1.5 发布:397B 模型代码能力匹敌 Claude Opus — testingcatalog · 2026-08-19
- Ornith-1.5 开源模型家族发布,397B 版对标 Claude Opus 4.8 — KokaOP · 2026-08-19
- Ornith-1.5 发布:9B 模型对标大模型,MIT 协议商用友好 — Shruti_0810 · 2026-08-20
- Ornith-1.5 开源模型发布,9B 版本端侧性能对标 Qwen — yacineMTB · 2026-08-20
- 开源 Ornith-1.5 发布:397B MoE 性能比肩 Claude Opus — Teknium · 2026-08-20
- Ornith-1.5 发布:397B MoE 模型对标 Claude Opus — aftahi_ai · 2026-08-20
- Ornith-1.5-35B 发布:推理编码超越 Qwen 与 Gemma — alejandroll10 · 2026-08-20
- Ornith-1.5 发布:自进化闭环,性能对标 Claude Opus 4.8 — alexcovo_eth · 2026-08-20
- Ornith 1.5 发布:MIT 授权的 9B/35B 开源模型与量化评测 — Fun-Meaning-6474 · 2026-08-20
- Ornith-1.5 发布:自改进循环对标 Claude Opus — aftahi_ai · 2026-08-20
- Ornith-1.5 宣称媲美 Claude Opus 4.8 — alexcovo_eth · 2026-08-20
- Ornith-1.5-35B-A3B 登顶 HF,基于 Qwen2.5 的多模态对话模型 — ornith-ai · 2026-08-20
- 开源 Ornith-1.5 发布:397B MoE 四项基准胜过 Claude Opus 4.8 — rohanpaul_ai · 2026-08-20
第 2 集 · 开源模型 Ornith-1.5-9B 登 Hugging Face 热榜(2026-08-20,2 条)
ornith-ai 发布的 Ornith-1.5-9B 模型热度持续攀升,登顶 Hugging Face 趋势榜。该模型基于 Qwen3.5 架构,支持图像与文本输入并具备对话与文本生成能力,采用 MIT 许可证开源,已推出 GGUF 量化版本,可通过端点直接使用。
- Ornith-1.5-9B 登顶 Hugging Face 热榜,支持图像文本输入 — ornith-ai · 2026-08-20
- Ornith-1.5-9B GGUF 版上架,登 Hugging Face 热榜 — ornith-ai · 2026-08-21