实测 Jev:数字母都只给概率,显然的问题也会答错
eptwts · x · 2026-09-20
作者用一个「数单词里有多少个 a」的小应用实测 Jev,揭示这类模型的关键短板:
- 模型不返回确定答案,而是返回概率分布,几乎从不满分确信。
- 大多数时候答对,但连这种显而易见的问题也会出错。
- 结论:模型确实有用,但不应用在零容错的系统里;最佳场景是在信息嘈杂的环境中做快速、结构化的判断。
所属事件:实测 Jev 数字母只给概率,LLM 确定性短板暴露(2 条相关)→
「模型」频道最新
- 实测 Jev 设备:快又便宜,但泛化能力只值 C- — intellectronica · 2026-09-20
- Bespoke 开源 Nimble:对标闭源 Jev 的类型化决策模型 — RexDouglass · 2026-09-20
- LFM2.5-230M 手机端实测:CPU 跑出 192 tok/s 生成速度 — Tall_Abrocoma_3533 · 2026-09-20
- 实测者痛批 Apple 基础模型 CLI 聊天「惨不忍睹」 — StefanoGogioso · 2026-09-20
- ChatGPT-6 首次破解尘封 108 年的一战德军密码 — Andune88 · 2026-09-20
- 开发者用分类模型 Jev 加速开源自托管记忆系统 Memry — FUNdationOne · 2026-09-20