Ornith-1.5 发布:自改进循环对标 Claude Opus
aftahi_ai · x · 2026-08-20
Ornith-1.5 是一组开源 LLM(9B Dense、35B MoE、397B MoE),采用端到端自改进策略训练。其核心是自改进循环:模型生成任务、构建框架、产出解法并通过强化学习从中迭代优化。该模型在 Terminal-Bench (86.1)、SWE-Bench (86 verified)、ClawEval (81.4) 等基准上取得了开源模型 SOTA 性能,综合表现可比肩 Claude Opus 4.8。
所属事件:开源模型 Ornith-1.5 发布,397B 版对标 Claude Opus 4.8(24 条相关)→
「模型」频道最新
- NVIDIA 公布 Qwen3.8-2.4T 模型部署方案:GB300 显卡吞吐超 4000 tokens/s — PyTorch · 2026-08-21
- 实战教程:通过继续预训练让本地 LLM 学习新领域 — funJS · 2026-08-21
- Qwen 3.8 27B两次对话就写出可玩3D游乐园,量化版也能打 — RandumbRedditor1000 · 2026-08-21
- 智谱 SAO 论文:单采样异步 RL 稳定训练千步,超越 GRPO — teortaxesTex · 2026-08-21
- Gemini 安全审查过严?连亲吻和公路拍照都拒 — Dry-Sympathy-3182 · 2026-08-21
- 0.63M 参数验证器媲美 7B 模型,AI 推理新极限 — jm_alexia · 2026-08-21