JEV「不会幻觉」存疑:同提示多次运行概率不一、选项顺序显著影响输出
FrankFelixAI · x · 2026-09-21
关于 JEV 的「无幻觉」宣传,@neuralavb 提出两点实测质疑:
- JEV 并非确定性运行:同样的 prompt 多次运行会得到不同的概率输出,与官方宣称的确定性相矛盾。
- 选项的排列顺序会剧烈改变输出概率。
作者澄清 JEV 本质是非生成式语言模型,只建模「给定语言上下文下各事物的概率」;它的真正保证是类型安全和答案确定性(无随机采样),但确定性不等于正确——答案仍可能自信地错,训练数据不足的话题上照样会幻觉。
「模型」频道最新
- 本地模型钓鱼实测:Gemma 4 中招 3/4 还跑了 shell 命令,Qwen 3.8 更抗骗 — divinetribe1 · 2026-09-21
- ChatGPT 时代 RLHF 老兵做新模型 Jev:为机器决策而非人类对话而生 — MaryamMiradi · 2026-09-21
- 开源模型占 Vercel AI Gateway token 量 78.4% 创新高 — ccerrato147 · 2026-09-21
- 网友调侃:Anthropic 员工疑似全员「Claude 同化」,说话腔调高度一致 — teortaxesTex · 2026-09-21
- 实测:Codex 额度消耗提速 5 倍,「token 大屠杀」要来了? — StewartalsopIII · 2026-09-21
- 观察:各家模型做工具调用时中间步骤风格各异 — DanielLockyer · 2026-09-21