专题 · FULL STORY

Ornith-1.5 发布:开源新秀冲击顶级模型

8月19日开源模型家族 Ornith-1.5 正式发布,提供 9B Dense、35B MoE 与 397B MoE 三种 MIT 协议开源配置,其中 397B 版对标 Claude Opus 4.8。随后数日内其 9B 版本热度攀升,登顶 Hugging Face 趋势榜,成为社区关注焦点。

2026-08-19 ~ 2026-08-21 · 2 集 · 26 条

第 1 集 · 开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus 4.8(2026-08-19,24 条)

8 月 19 日,开源模型家族 Ornith-1.5 正式发布,包含 9B Dense、35B MoE 与 397B MoE 三种配置,采用 MIT 协议开源,覆盖从端侧到大规模部署的不同推理需求。据 @testingcatalog,发布方为 DeepReinforce;@alexcovoeth 转述其为美国团队,@Fun-Meaning-6474 提到发布主体亦称 Ornith Lab,并补充 9B 密集版具备视觉能力。旗舰 397B 版在 Terminal-Bench 2.1 上得分 86.1,官方称整体性能在推理、Agent 与编程任务上比肩 Claude Opus 4.8;据 @rohanpaulai 转述口径,397B 版在多项基准上与 Claude Opus 4.8 相当。目前这些成绩均来自发布方自评,尚无独立第三方复现验证。

已确认

  • 模型规格与 MIT 许可为官方信息,由 @tarruda 首先发布;@KokaOP 同日给出家族概览,@testingcatalog 补充发布方名称 DeepReinforce。
  • @KokaOP、@testingcatalog 等多条帖子均给出 397B 版在 Terminal-Bench 2.1 得分 86.1 的具体成绩,另有 SWE-bench 等基准成绩展示。
  • 据 @ornith-ai,Ornith-1.5-35B-A3B 发布次日即在 Hugging Face 趋势榜热度上升,该版本为多模态对话模型,采用 Qwen2.5-MoE 架构,支持图像文本到文本生成,MIT 许可。
  • 据 @ollama 转发,Ornith-1.5 全系三种尺寸已上线 Ollama,个人用户可便捷本地部署。
  • 核心技术亮点是端到端自我改进训练策略:据 @aftahiai 等转述,模型能自主提出新任务、生成特定脚手架并产出强化学习解决方案,持续为自己创建学习经验,而非被动完成任务。
  • @Shruti0810 补充称 9B 版在多个基准测试中可与更大模型竞争,且 MIT 协议对商用友好。
  • 据 @Fun-Meaning-6474,AtomicChat 团队已在发布次日(8 月 20 日)推出针对 9B 密集版与 35B-A3B MoE 版的量化版本及评测。
  • 据 @alejandroll10 转述,35B MoE 版在推理、编码与智能体基准上超越同量级的 Qwen 3.6-35B,每 Token 仅激活 3B 参数,仍优于密集模型 Gemma 4-31B 与 Meta 的 Muse 系列(此为转发口径,未见原始评测佐证)。

尚未确认

  • 「媲美 Claude Opus 4.8」等结论目前主要来自发布方自己的评测与宣传,尚缺独立第三方复现验证;@iamfakhrealam、@aftahiai、@Teknium 等多条转发均重复同一口径,未见新增独立证据。
  • @aftahiai 转发中提到的「对标 GPT-4.5」无具体数据支撑;@alexcovoeth 转发的演示视频显示 9B 模型可在断网环境下运行完整智能体,属转述口径,暂无一手评测佐证。

为什么重要

  • 端到端自我改进(模型自己生成学习任务与脚手架)是区别于常规后训练的新范式,若复现成立,可能降低对人工构造训练数据的依赖。
  • MIT 协议加上从 9B 到 397B MoE 的完整规格覆盖,让个人开发者到大型部署方都能取用;35B-A3B 登上 Hugging Face 趋势榜、全系上线 Ollama、AtomicChat 量化版在发布次日即出现,说明社区生态快速跟进,是开源阵营对闭源顶配模型的一次直接对标。

还有 4 条相关讨论 →

第 2 集 · 开源模型 Ornith-1.5-9B 登 Hugging Face 热榜(2026-08-20,2 条)

ornith-ai 发布的 Ornith-1.5-9B 模型热度持续攀升,登顶 Hugging Face 趋势榜。该模型基于 Qwen3.5 架构,支持图像与文本输入并具备对话与文本生成能力,采用 MIT 许可证开源,已推出 GGUF 量化版本,可通过端点直接使用。