开发者称早一年做出非自回归决策模型,前沿实验室 Jev 却自称突破
JFPuget · x · 2026-09-20
作者 Nandakishor 称,早在一年的 2025 年 3 月就发布了非自回归决策模型的 arXiv 论文(arXiv:2503.23303),并在 Hugging Face 开源了模型权重与 SaaS 销售对话数据集,还发布了 PyPI 包:该系统用强化学习(PPO)在序列表征上输出逐轮转化概率预测,构建了 sub-40ms 的开源 System 1 决策引擎 RLCD,并于 2025 年 9 月发布第二篇论文完善 schema 决策 + RL 框架(arXiv:2510.01237)。
而由 OpenAI ChatGPT 联合发明人 Diogo Almeida 创立的前沿实验室 TypeSafe AI 于 2026 年 9 月推出 Jev,提出几乎相同的非自回归决策概念并称其为科学突破——但没有技术论文、没有开源权重、没有开放训练数据集。作者表示既感到被验证又深感沮丧,并对比指出自己的方法核心一直是强化学习而非嵌入模型或自回归 LLM,Jev 将并行采样思路做了泛化。
所属事件:创业者称早一年发表非自回归决策模型,指前沿实验室重复成果(2 条相关)→
「研究」频道最新
- 45 位专家检验 AI 审稿:评估 Nature 系论文评审的极限与机会 — windx0303 · 2026-09-20
- LeCun 参与的 Aspen 世界模型×物理工作坊开放报名,2027 年 2 月举办 — ylecun · 2026-09-20
- Claude 独立完成 RSA-896 因数分解,RSA 挑战数再破一个 — Singularitarian · 2026-09-20
- RSA-896 分解进展登上 Hacker News 热议 — madars · 2026-09-20
- Hugging Face 出现 JEV 复现追踪看板,集中记录论文复现进展 — multimodalart · 2026-09-20
- GAVEL:不改模型,仅靠 harness 把 Qwen3-8B 从 41.2% 提到 91.8% — dair_ai · 2026-09-20