Tavus 实时 AI 视频通话爆火:虚拟人像会调你网页里的函数
TejasKumar_ · x · 2026-10-02
工程师 Tejas Kumar 用 Tavus 新的实时 AI 视频通话能力做了一个演示页面,与一个不是真人的 AI 形象「Priya」进行 3 分钟视频通话,全程在浏览器内展示底层通信:
- 四模型流水线:Sparrow-2 负责判断你何时说完话(语气+停顿),Raven-1 处理摄像头与屏幕共享的视觉理解,生成由 tavus-gemma-4 驱动,Tavus 实时绘制人脸。
- 浏览器内函数调用:AI 可直接调用页面里的工具函数——查演讲日程、搜索作者过往演讲内容、现场写 React debounce hook、读你屏幕上的代码找 bug、识别你举到镜头前的物品、甚至切换页面主题,工具往返全程可见。
- 页面实时展示每一轮端到端延迟(从你停止说话到虚拟人像开口)、数据通道消息和完整 wire 日志,可导出为 JSON。
演示强调隐私:不录制、仅 3 分钟通话。这是少见的把 AI 视频通话的多模型链路和 tool calling 完全透明化的公开 demo。
「编程与Agent」频道最新
- exe.dev:别再堆任务管理面板,请少跑一些 Agent — charles_irl · 2026-10-02
- 开发者搭出多智能体 ML 团队:人类只需审批,token 省 40% — kmeanskaran · 2026-10-02
- Claude Code 作者:别再写 prompt 了,我的工作是写循环 — aakashgupta · 2026-10-02
- InVideo MCP 上线:用 Claude 等 agent 直接控制视频编辑器 — LudovicCreator · 2026-10-02
- Atlassian 白皮书:74% 团队用 AI 加速写码,近 80% 仍人工评审 — MaryamMiradi · 2026-10-02
- Hamel Husain:为什么用二元 pass/fail 评测,别用 1-5 打分 — HamelHusain · 2026-10-02