Ornith-1.5 发布:自进化闭环,性能对标 Claude Opus 4.8
alexcovo_eth · x · 2026-08-20
美国 DeepReinforce 团队发布 Ornith-1.5 开源模型系列(9B Dense / 35B MoE / 397B MoE),采用革命性自我改进训练闭环(自提任务、生成交架、Rollout 强化)。模型在 Terminal-Bench (86.1)、SWE-Bench Verified (86) 等基准上表现优异,性能直逼 Claude Opus 4.8。35B 版本大幅碾压同尺寸 Qwen 3.6,9B 量化版仅 1.5GB 可跑手机。支持 FP8/GGUF/MLX,MIT 协议无限制商用。
所属事件:开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus 4.8(24 条相关)→
「模型」频道最新
- NVIDIA 公布 Qwen3.8-2.4T 模型部署方案:GB300 显卡吞吐超 4000 tokens/s — PyTorch · 2026-08-21
- 实战教程:通过继续预训练让本地 LLM 学习新领域 — funJS · 2026-08-21
- Qwen 3.8 27B两次对话就写出可玩3D游乐园,量化版也能打 — RandumbRedditor1000 · 2026-08-21
- 智谱 SAO 论文:单采样异步 RL 稳定训练千步,超越 GRPO — teortaxesTex · 2026-08-21
- Gemini 安全审查过严?连亲吻和公路拍照都拒 — Dry-Sympathy-3182 · 2026-08-21
- 0.63M 参数验证器媲美 7B 模型,AI 推理新极限 — jm_alexia · 2026-08-21