CLM-8B 零样本评测:比 Jev 快至 9 倍且性能持平
Azaliamirh · x · 2026-09-24
作者发布 CLM-8B 与 Jev 的零样本评测线程:在 computer-use、游戏、工具调用等任务上,CLM-8B 性能与 Jev 持平,但速度最高快 9 倍。加速在候选数量大(如 WikiRacing)或动作可跨状态复用(如 T-Rex Game)的场景最明显。泛化性更强、加速更大的 CLM-35B 将于下月初发布。
「模型」频道最新
- Jev 被指比 DeepSeek 更值得警惕:API 即用、几分钱一次决策,让浪费无处遁形 — jobergum · 2026-09-24
- ChatGPT 免费用户解除 GPT-5.6 Luna 消息条数上限,可无限续聊 — Aiden_Tech_Ai · 2026-09-24
- Grok 4.7 登 AutoResearchExam 长程研究榜,24 小时自动研究排第 4 — AlexGDimakis · 2026-09-24
- 知名研究者 _xjdr:不喜欢 astra,想回退 5.6,还好奇 Opus 5.5 — _xjdr · 2026-09-24
- OpenAI 心理健康基准遭剖析:临床医生得分反而低于模型 — r0ck3t23 · 2026-09-24
- 模型找 bug 能力越强成本指数级上涨,Paweł Huryn 实测揭示性价比曲线 — garrytan · 2026-09-24