开源小模型 Jev 被指未致谢灵感来源 Lava,上下文仅 8192 引热议
nischay_twt · x · 2026-09-21
JFPuget 指出开源模型 Jev 的明显先行工作 Lava:Lava 更快但上下文限制在 8192 token。他猜测 Jev 的做法可能是把 ModernBert 换成自回归编码器(如 1.7B 的 Qwen 模型)来解决上下文问题,但 Jev 并未在项目中致谢 Lava 这一灵感来源。
「模型」频道最新
- Mollick:Claude 缺图像生成器,是智能体知识工作的短板 — emollick · 2026-09-21
- GPT-6 3D 炫技后翻车:让 AI 设计个把手,差点真去 3D 打印 — ngxson · 2026-09-21
- 实测模型路由多智能体组合:成本接近 Astra 单模型还跑不完任务 — kevinkern · 2026-09-21
- 斯坦福教授:扩散模型让推理像训练,GPU终于干回本行 — victor_explore · 2026-09-21
- 用户吐槽 Codex 月费 200 美元使用频率低,拟转投开源模型 — haydendevs · 2026-09-21
- 预注册实测 Jev「不幻觉」声明:类型安全零违规,置信度校准数据集间分裂 — NervousAd4440 · 2026-09-21