Jev + Cua Driver 电脑操作实测:8/9 通过,决策快 13.6 倍
iamrobotbear · x · 2026-09-17
francedot 分享对 TypesafeAI 新模型 Jev 的 computer use 实测:搭配 Cua Driver,Jev 通过 8/9 个可执行任务(Astra/Codex 为 9/9),但中位决策速度比后者快 13.6 倍,中位任务耗时低 27%。
作者的观点:当模型对 UI 有可用的结构化表示后,computer use 的很大一部分会变成一个通用决策问题。这是 Jev 首次公开版本,实测规模虽小但结果值得注意。
「编程与Agent」频道最新
- 小模型+Kimi K3 级联路由:百封邮件欺诈检测仅花 7 美分 — nutlope · 2026-09-17
- AWS 官方对比 Bedrock 三种向量库:OpenSearch、pgvector 与 S3 Vectors — AWS ML Blog · 2026-09-17
- 多智能体找到更多 bug?先核对搜索范围和 token 预算 — gethackteam · 2026-09-17
- Xcode 27.1 将内置新 skill:自动适配应用各尺寸布局 — JordanMorgan10 · 2026-09-17
- Google 推出 Agent Anomaly Detection,异步监控智能体异常行为 — rseroter · 2026-09-17
- 开发者分享工作流:手机长对话出方案文档,再交 GLM 写码 — dbreunig · 2026-09-17