开发者称早一年做出非自回归决策模型,前沿实验室 Jev 却自称突破

JFPuget · x · 2026-09-20

作者 Nandakishor 称,早在一年的 2025 年 3 月就发布了非自回归决策模型的 arXiv 论文(arXiv:2503.23303),并在 Hugging Face 开源了模型权重与 SaaS 销售对话数据集,还发布了 PyPI 包:该系统用强化学习(PPO)在序列表征上输出逐轮转化概率预测,构建了 sub-40ms 的开源 System 1 决策引擎 RLCD,并于 2025 年 9 月发布第二篇论文完善 schema 决策 + RL 框架(arXiv:2510.01237)。

而由 OpenAI ChatGPT 联合发明人 Diogo Almeida 创立的前沿实验室 TypeSafe AI 于 2026 年 9 月推出 Jev,提出几乎相同的非自回归决策概念并称其为科学突破——但没有技术论文、没有开源权重、没有开放训练数据集。作者表示既感到被验证又深感沮丧,并对比指出自己的方法核心一直是强化学习而非嵌入模型或自回归 LLM,Jev 将并行采样思路做了泛化。

所属事件:创业者称早一年发表非自回归决策模型,指前沿实验室重复成果(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →