Jev 高频实测摸底:中文拉胯、无推理,只适合封闭小决策

ZeYanjie · x · 2026-09-20

作者几天高频实测后总结 Jev 的能力边界:它极其依赖使用者划定的严格约束,开放复杂任务行不通。

结论:Jev 的适用场景非常细分——高实时、只要确定性结论的封闭任务(如邮件分流实测:300 封信 9.9 秒分流到 15 个部门仅花 $0.036,同任务 DeepSeek 同期只读了 10 封)。作者呼吁社区开发一个 Jev harness。

所属事件:高频实测 Jev:中文表现差、边界明显(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →