Burkov 锐评神秘项目 Jev:号称秒杀 LLM,结论是 BS
burkov · x · 2026-09-21
《百页机器学习书》作者 Andriy Burkov 公开了他对新项目 Jev 的评价:宣称比 LLM 快得多,但只与普通 LLM 对比;若对象是 diffusion LLM,优势未必存在,甚至可能本身就是 diffusion LLM。其「校准决策」卖点——在 System One 任务上给出认知诚实概率——也被质疑:还没见过用户的任务,怎么能宣称对「我的任务」校准?在官方提供更多实际细节之前,Burkov 的结论是 BS。
「模型」频道最新
- Hemmingway-1 开源:27B 纯写作模型 EQ-Bench 4 得 1330,超 GPT-5.5 — Lukinator6446 · 2026-09-21
- 观察:Astra 极度怕犯错,大量本地测试却 reluctance 真实部署 — xiaosun86 · 2026-09-21
- 受 Jev 启发,开发者打造「通用行动模型」Vector — BLUECOW009 · 2026-09-21
- Sentdex 实测 Jev:作为 LLM 增强可省 token,态度转暖 — Sentdex · 2026-09-21
- 本地模型钓鱼实测:Gemma 4 中招 3/4 还跑了 shell 命令,Qwen 3.8 更抗骗 — divinetribe1 · 2026-09-21
- ChatGPT 时代 RLHF 老兵做新模型 Jev:为机器决策而非人类对话而生 — MaryamMiradi · 2026-09-21