通宵训练类 JEV 模型,120 道难题仅得 24% 分
BLUECOW009 · x · 2026-09-22
作者分享了一手实验结果:通宵训练了一个 JEV 风格的模型,在 120 道高难度任务上只拿到 24% 的成绩,结论是「还不值得」。属于小规模训练尝试的负结果分享,信息量有限但对想复现类似 run 的人有参考价值。
「研究」频道最新
- Question's Gambit:检索前预处理让 GPT-5.5 深研成绩从 83.1% 升至 90.5% — omarsar0 · 2026-09-22
- PyroDash:小模型按需呼叫大模型,推理成本降96%反超单独用大模型 — jiqizhixin · 2026-09-22
- 不改权重、18MB KV 缓存即可按请求移除 LLM 拒答行为 — Anony6666 · 2026-09-22
- AI 数学证明该按什么标准?Lean ≠ ZFC,规则变更没经过投票 — jessi_cata · 2026-09-22
- 剑桥学者 David Krueger:四大根本问题未解,AI 安全不能指望限期攻关 — DavidSKrueger · 2026-09-22
- peano_ai 在 1000+ TPU 上对 310B 模型跑通全参数 RL 训练 — simonguozirui · 2026-09-22