免微调复现 Jev:读 true/false logits,27B 达 75.5% 准确率

Malfeitor1235 · reddit · 2026-09-21

开发者 VakeDomen 发布 DIY-Jev:不用 NLI 微调或分类头,用完全未修改的开源权重模型做 Jev 式推理验证。

方法:把每个候选答案转成布尔判断——拼接 <state>/<question>/<options>/<candidate> 后,不生成文本,直接读取 true/false 的 logits,对每个候选求差再 softmax(昂贵的前缀只算一次,候选分支仅末尾 token 不同,批量过 llama.cpp)。

32,235 例基准成绩(笔记本 RTX 5090 24GB):

有意思的结论:不训练任何东西、只靠读 logits,同一模型可超过 OpenJev 的微调版。作者声明不保证严格复现 Jev、基准也非完全对齐,但展示了「零训练调提示」的上限。代码开源于 GitHub DIY-Jev。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →