Jev 创始人 Diogo Almeida:RLHF 是 LLM 通往自动化的史诗级弯路
dotey · x · 2026-09-20
转述 Jev 创始人 Diogo Almeida 的演讲,其核心观点:
- Jev 从一开始就瞄准自动化。Almeida 认为当前 LLM 陷入大弯路:RLHF 在「取悦人类」上出色,在自动化上糟糕——它注定无法让人类退出流程。
- ChatGPT 与 Claude Code 同属一个范式:两者原罪都在 RLHF,Claude Code 并不代表下一个时代;真正的完全自动化才是。
- RLVR 也不是答案:RLHF 优化人类偏好,RLVR 优化纯正确性,而他们走第三条路——优化「校准过的决策能力」。
- 数据比算力重要,任务比数据重要:预训练模型已经足够聪明,问题在于偏好优化把它「挖歪了」。
演讲视频翻译使用了 BaoCut 制作。
所属事件:Jev 创始人:RLHF 是 LLM 通往自动化的弯路(2 条相关)→
「漫话AGI」频道最新
- Domingos 调侃 Dario 与 Sam:没人需要比你俩更慢地前进 — pmddomingos · 2026-09-20
- 加密先驱 van der Chijs 卖币投 AI,警告 AI 或冲击银行体系 — marcvanderchijs · 2026-09-20
- Tanmoy Chak 做客 BBC 印地语台,谈 AI 威胁有多真实 — Tanmoy_Chak · 2026-09-20
- 学者呼吁:论文可用任何语言提交,AI 翻译兜底 — birchlse · 2026-09-20
- 学者警告:AI 评审自己论文时,作弊将不可避免 — Michael_J_Black · 2026-09-20
- 《模型不会失控》:质疑 AI 失控叙事的深度长文 — hologram137 · 2026-09-20