jev-use 开源:不用截图读辅助功能树,Mac 语音操控比 LLM 快 100 倍
_AustinCalvert_ · x · 2026-09-21
开发者 savka777 开源了 jev-use,一个基于 TypeSafe 模型 Jev 的 macOS 语音/文字电脑操控框架(GitHub 已获 65 star)。
核心思路是不截图、不用视觉模型:
- 读取屏幕的 Accessibility(辅助功能)树作为状态输入
- Jev 一次性选出动作和目标元素
- 由 macOS 原生执行,然后检查屏幕变化、循环往复
作者称这个 harness 因绕过视觉模型而比任何 LLM 截图方案快约 100 倍。支持按住 Control–Option–Space 说话下达指令,也可以打字或命令行调用(如 scripts/say.sh "Open Finder"),例如「打开 Obsidian 新建笔记输入 hello」「平铺所有 Brave 窗口」等。需要 macOS 14.2+ 和 Xcode,无第三方依赖,API key 存入 Keychain。
「编程与Agent」频道最新
- DavidKPiano 预言:用 Markdown 写 Agent 控制流的潮流两个月内会被看衰 — DavidKPiano · 2026-09-21
- 开源决策模型 Kev 发布 0.6B/4B/8B,单张 H100 训练 40 分钟 — TheMoonMidas · 2026-09-21
- 开发者观点:GPT 太慢,jev 类高频控制器是 Agent 真正缺的一环 — flowersslop · 2026-09-21
- Hermes Agent 可向任意 OpenAI 兼容客户端实时流式输出推理过程 — Teknium · 2026-09-21
- 开发者激辩:代码审查自动化后,新手还该不该学编程 — mgill25 · 2026-09-21
- 老手带新手 vibecoding 感悟:沟通与系统思维才是关键 — eschadiol · 2026-09-21