Ornith-1.5 发布:端到端自改进模型,性能匹敌 Claude Opus
rohanpaul_ai · x · 2026-08-19
Ornith-1.5 是一个通过端到端自改进构建的基础模型,扩展了自脚手架框架。模型提出新任务、生成特定脚手架并产生强化学习解决方案,持续创建学习经验。
模型规格与性能:
- 397B MoE: 在 Terminal-Bench 2.1 得分 86.1,DeepSWE 得分 56.0,与 Claude Opus 4.8 持平,超越 GLM-5.2 和 DeepSeek-V4-Flash。
- 35B MoE: 每个 token 仅激活 3B 参数,在代理编码任务上大幅超越 Gemma 4-31B 和 Meta Muse Glimmer-30B。
- 9B Dense: 移动端量化版本可在手机部署,性能显著超越更大的 Gemma 4-31B 和 Qwen 3.6-35B。
所属事件:开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus(9 条相关)→
「模型」频道最新
- Ling-3.0 开源:发布 6 个基础检查点,引入 WSM 训练法 — bclavie · 2026-08-19
- Grok 4.6 登陆 Amazon Bedrock:500k 上下文、四档推理力度 — SpaceXAI · 2026-08-19
- empero-ai 上架 Qwen3.8-9B 蒸馏模型,冲上 Hugging Face 热榜 — empero-ai · 2026-08-19
- z-lab 发布 Qwen3.8-27B DFlash2:块扩散草稿模型加速推理 — z-lab · 2026-08-19
- Qwen3.8-9B 蒸馏模型推出 GGUF 版,llama.cpp 本地量化可跑 — empero-ai · 2026-08-19
- Replit 免费模式上线:20 美元月费够部署 10+ 应用 — amasad · 2026-08-19