NeoHorse-1 论文提出用 Agentic 后训练实现递归自我改进
_akhaliq · x · 2026-09-10
TokenRhythm 团队在 Hugging Face 发布 NeoHorse-1 论文,主题为「通过带 Routing Harness 的 Agentic 后训练实现递归自我改进」,同时公开了 HF 模型合集与 GitHub 仓库。论文主张用智能体化的后训练流程配合路由机制,让模型在迭代中自我提升。方法较新、尚未经广泛验证,细节需参考原文。
所属事件:NeoHorse-1 论文提出递归自我改进的 Agentic 后训练路线(2 条相关)→
「研究」频道最新
- 预测千禧年大奖难题攻克顺序:黎曼猜想第三,P vs NP 最后 — OfirPress · 2026-09-10
- 研究揭示 LLM 预训练获取事实知识:记忆延迟30步、重复数据加速遗忘 — gordic_aleksa · 2026-09-10
- DeepMind 播客谈 AI 气象预报:WeatherNext 3 助力飓风 Melissa 预警 — PeterWBattaglia · 2026-09-10
- 给 Agent 配上 shell 后上下文格式差距不缩反扩:从 50 分拉大到 74 分 — arch1v1sor · 2026-09-10
- Project CETI 用 AI 发现抹香鲸叫声中类似人类元音的模式 — begusgasper · 2026-09-10
- 前字节 AI 实验室负责人创办 Geodesic,发布 AI 蛋白药物平台 — QuanquanGu · 2026-09-10