开发者用 OpenAI 视觉 API 做手势识别,比旧方案更快更准
pvncher · x · 2026-10-07
开发者 seflless 演示用 OpenAI 的 Decisions API 做手势识别:借助其视觉理解能力,准确率明显超过他之前基于 Jev(纯形状识别)的演示,速度也更快。此前他尝试用 Jev 做形状识别,结果参差但速度不错,当时就期待多模态能力「开箱即用」——这次的视觉 API 版本验证了这一点。
「编程与Agent」频道最新
- TTT 记忆让智能体持续学习,作者将在 COLM 高效推理工作坊分享 — JunjieHu12 · 2026-10-08
- LangChain 出 2 分钟课程:用 Agent Skills 保护上下文窗口 — LangChain · 2026-10-08
- Kent Beck 演讲:AI 编码需在功能堆叠与投资未来间找平衡 — moarbugs · 2026-10-08
- Grok Bot 曝开发 Meetings 功能,可入会 Google Meet/Zoom 开晨会 — testingcatalog · 2026-10-08
- uTTT 论文:跨层共享单一快权重记忆,提升长上下文与测试时学习 — JunjieHu12 · 2026-10-08
- 同款模型表现迥异:Dylan Patel 谈 harness 如何改变 AI 性能 — MatthewBerman · 2026-10-08