Stanford 发布 CLM:8B 模型推理快 9 倍,登顶 Terminal-Bench
StanfordAILab · x · 2026-09-25
Stanford 团队(Hazy Research 等)推出 Contrastive Language Model (CLM),一种超快的 System 1 模型,用对比学习目标直接连接状态与动作:
- CLM-8B 在互联网规模数据上预训练,推理速度最高比 Jev 快 9 倍,在 computer use、游戏、tool calling 上性能相当
- 轻量微调后在 agent 编码基准刷新 SOTA:DeepSWE 81.6%、Terminal-Bench 2.1 87.6%;相比之下 Jev 难以胜任这些长程任务的验证器角色
- 团队还构建了状态与动作解耦的高效训练与服务基础设施,并建立了跨算力、模型规模、数据规模的 scaling laws
论文、代码、模型与数据均已开源发布。
所属事件:Stanford 发布 CLM-8B:推理快 9 倍登顶智能体编码榜(4 条相关)→
「编程与Agent」频道最新
- Stacked PR 实战仓库:gh stack CLI 教程加 AI 编码 agent 工作坊 — DanWahlin · 2026-09-25
- AI 浏览器 Energy 支持代登录与刷卡,凭据仅存本地不进 LLM — emilahlback · 2026-09-25
- OpenRouter 推出统一 Web 搜索服务工具,各家定价公开可对比 — jeff_weinstein · 2026-09-25
- Firecrawl 推出 Alexandria 接入 Claude:1.13 亿+数据源评测得分高 21% — devdigest · 2026-09-25
- 开发者用 GitHub Copilot 的 Jev 搭智能家居控制器:简单、快、便宜 — DanWahlin · 2026-09-25
- Hyperagent 发布 Rooms:多智能体与人类同群协作新形态 — aakashgupta · 2026-09-25