前 OpenAI 研究者造 Jev:不做聊天,做机器原生的编程模型
Latent Space · youtube · 2026-09-22
Latent Space 播客专访 TypeSafe 联合创始人兼 CEO Diogo Almeida(前 OpenAI 指令遵循模型团队)。Jev 发布数天后上线节目,核心主张是下一波 AI 不是聊天,而是「System One Models」——为代码、校准决策、可靠性和单位美元智能而生的机器原生 AI。
要点:
- 为什么 AI 解得了极难问题却自动化不了基础工作,以及 Jev 如何针对这一点设计
- RLHF 的失败模式:mode collapse、校准问题与为人类偏好优化的隐性成本;RLCD 作为与 RLHF/RLVR 不同的北极星
- 拒绝刷公开榜单,改为优化 intelligence per dollar;「最苦涩的教训」:任务和数据可能比堆算力更重要,TypeSafe 自我定位为 data lab 而非 model lab
- 拒绝与安全的新问题:当 AI 埋进软件依赖里,refusal 变成根本性不同的难题
- 编码代理架构:用结构化状态取代巨型 prompt 与 system message;把 AI 工作流拆成许多小而可测的决策;超越 KV cache 的共享状态、子代理与多代理软件
- 「逆向 SaaS 末日」:AI 可能反而为现有软件赋能,让 AI 消失到软件后台
- 即使给他十亿美元,也不会从零预训练模型
所属事件:前OpenAI研究员发布「System 1」决策模型Jev(15 条相关)→
「编程与Agent」频道最新
- Foundation Capital:企业级 Agent 基建需要四大控制与为 AI 重建 Web — brucemacv · 2026-09-22
- Question's Gambit:检索前预处理让 GPT-5.5 深研成绩从 83.1% 升至 90.5% — omarsar0 · 2026-09-22
- 开发者开源 e-drums 接入 Ableton 工具,称可让 agent 适配任意电鼓 — _Dave__White_ · 2026-09-22
- Chollet:可以委托写码,永远不要委托理解 — round · 2026-09-22
- 开发者用 Jev 自动审核社交媒体帖子并开源 npm 包 modsure — RealDannyhvv · 2026-09-22
- TypeSafe 两级抽取级联:小模型初抽+验证器把关,成本仅推理模型零头 — TheMoonMidas · 2026-09-22