对比学习语言模型 CLM-8B:推理快至 9 倍,刷榜智能体编码基准
ChengleiSi · x · 2026-09-24
团队发布 Contrastive Language Model (CLM),一种用对比学习目标连接状态与动作的超快「System One」模型。
- 性能:CLM-8B 在互联网规模数据上预训练,推理速度最高比 Jev 快 9 倍,同时在 computer-use、游戏和工具调用任务上表现相当
- 基准:轻量微调后在 DeepSWE (81.6%) 和 Terminal-Bench 2.1 (87.6%) 等 agentic coding 基准上刷新 SOTA;而 Jev 在这些长程任务上无法充当有效验证器
- 基础设施:通过状态与动作解耦的 disaggregation 设计,允许嵌入分别缓存复用,在状态持续演化而动作集合固定的场景下大幅降低推理延迟
「模型」频道最新
- 曝 OpenAI 效率布局:GPT-6 Luna 主打性价比,Sol 低价保留多数智能 — haider1 · 2026-09-24
- 网传「Claude Opus 5.5 对 ChatGPT 6 Astra」对比视频,模型名存疑 — balianone · 2026-09-24
- 拍 4 张白板照片,Astra 一次完成识别、OCR 并矢量化 — iskander · 2026-09-24
- 用户实感:Claude 额度机制生变,本周主要被 Opus 限额卡住 — rudrank · 2026-09-24
- 用户质疑 OpenAI 用 Sol 换皮 Terra 降价却砍用量额度 — RexDouglass · 2026-09-24
- 生成 demoscene demo 只用掉 Opus 5.5 周额度的不到 3% — gandamu_ml · 2026-09-24