H2O 开源 4B 决策模型 Lightning,登顶 JevBench 开源榜
pseudotensor1234 · reddit · 2026-10-10
H2O.ai 发布 Apache-2.0 开源模型 H2O-Lightning-4B,面向 Jev 带火的「决策 API」推理模式:输入状态加类型化问题(单选/是否/打分),单次前向传播返回校准概率,不生成 token,因此快且便宜。JevBench 综合分 72.5,超过 Jev 1.13 的 71.5,为当前开源榜第一。技术上基于 Qwen3.5-4B 微调,普通 vLLM 加开源 shim 即可运行,H100 上单次决策约 30ms,数据本地、无按次收费。12B 和 31B 版本即将推出,内部测试显示显著强于 Jev。提供 1000 条保险理赔分诊、多浏览器 web agent、DOOM 等 demo,权重与部署说明已在 Hugging Face 公开。
「模型」频道最新
- 纽约 AI 晚宴纪要:推理优化靠 agent 找、代码审查已不划算 — paulnovosad · 2026-10-10
- 中国免费开源模型会否催生 ChatGPT 的平价替代 Agent? — jade_jade_jade_jade · 2026-10-10
- PostTrain Agent 全自动后训练拿 PostTrainBench 榜首,距人类专家仅差 4.5 分 — jiqizhixin · 2026-10-10
- OpenAI 论文众包团队用人类+Agent 协作推进,新前沿模型或即将发布 — RexDouglass · 2026-10-10
- 回顾早期 GPT 评测:GPT-2 学英语时顺带学会了 JavaScript — moyix · 2026-10-10
- 用户与 Claude 争论决策理论:模型默认反叛为理性,被说服后改口 — xuanalogue · 2026-10-10