Ornith-1.5 揭秘:自建任务与脚手架的闭环训练机制
HeyAmit_ · x · 2026-08-20
Ornith-1.5 展示了一种新颖的训练循环:模型不仅能给出跑分,还能自主提出新任务、构建特定任务的脚手架,并生成下一轮的自学习经验。这种自我进化的训练过程比单纯的基准测试表格更具研究价值。
「研究」频道最新
- 清华提出受脑启发的两阶段视觉感知框架 — jiqizhixin · 2026-08-20
- 观点:通过无解问题测试才是衡量发现能力 — eyishazyer · 2026-08-20
- Claude Opus 5 加 Code 技巧在 ARC-AGI 3 获满分 — Tolopono · 2026-08-20
- DAVID-GRPO:低成本 GPU 训练小模型多跳推理 — _reachsumit · 2026-08-20
- Netflix 用 CLIP 与自研三模态模型重构推荐素材个性化,冷启动大幅改善 — _reachsumit · 2026-08-20
- 小红书 OneModel 统一多场景推荐与广告排序 — _reachsumit · 2026-08-20