开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus
8 月 19 日,开源模型家族 Ornith-1.5 正式发布,包含 9B Dense(密集版)、35B MoE 与 397B MoE(混合专家版)三种配置,采用 MIT 协议开源,为不同推理需求和资源限制提供多种规模选择。据 @testingcatalog,发布方为 DeepReinforce;旗舰版 397B 在 Terminal-Bench 2.1 上得分 86.1,另在 SWE-bench 等基准上亦有成绩展示。
已确认
- 模型由 @tarruda 首先发布,三种规格与 MIT 许可均为官方信息;@testingcatalog 补充了发布方名称 DeepReinforce。
- 核心技术亮点是端到端自我改进训练策略:据 @rohanpaulai 转述,模型扩展了自脚手架框架,能自主提出新任务、生成特定脚手架并产出强化学习解决方案,持续为自己创建学习经验,而不只是被动完成任务。
- 官方评测声称其在推理、Agent 与编程任务上达到同尺寸开源模型的 SOTA,性能逼近甚至可比肩 Claude Opus 4.8;@testingcatalog 给出 397B 版在 Terminal-Bench 2.1 得分 86.1 的具体成绩。
尚未确认
- 「媲美 Claude Opus 4.8」等结论目前主要来自发布方自己的评测与宣传,尚缺独立第三方复现验证;@iamfakhrealam 与 @aftahiai 的多条转发均重复同一口径,未见新增独立证据。
为什么重要
- 端到端自我改进(模型自己生成学习任务与脚手架)是一种区别于常规后训练的新范式,若复现成立,可能降低对人工构造训练数据的依赖。
- MIT 协议加上从 9B 到 397B MoE 的完整规格覆盖,让从个人开发者到大型部署方都能取用,是开源阵营对闭源顶配模型的一次直接对标。
2026-08-19 ~ 2026-08-19 · 9 条相关
一手来源
- 新模型 Ornith 1.5 发布:9B 密集版与 35B/397B MoE 版 — tarruda ·
- Ornith-1.5 发布:397B 模型代码能力匹敌 Claude Opus — testingcatalog ·
- Ornith-1.5 发布:端到端自改进模型,性能匹敌 Claude Opus — rohanpaul_ai ·
- 【源头】新模型 Ornith 1.5 发布:9B 密集版与 35B/397B MoE 版 — tarruda · 2026-08-19
- 开源模型 Ornith-1.5 登场,推理编程直逼 Claude Opus — aftahi_ai · 2026-08-19
- MIT许可开源模型Ornith-1.5发布:自称可媲美Claude Opus — iamfakhrealam · 2026-08-19
- 对标 GPT-4.5?开源模型 Ornith-1.5 自我改进刷榜 — aftahi_ai · 2026-08-19
- 【源头】Ornith-1.5 发布:端到端自改进模型,性能匹敌 Claude Opus — rohanpaul_ai · 2026-08-19
- Ornith-1.5 开源模型家族发布,397B 版对标 Claude Opus 4.8 — KokaOP · 2026-08-19
另有 3 条近重复转述:aftahi_ai · aftahi_ai · testingcatalog