用户探索 GLM 视频输入玩法:录屏找 UI bug,语音识别仍弱

DevDminGod · x · 2026-09-16

开发者在讨论 GLM(flash-5.3)视频输入的使用思路:一个可行玩法是录制屏幕视频让模型找 UI bug;但语音部分识别不佳,作者建议把口述内容转成文字再输入,模型主要还是吃画面信息。属于早期用户的实践观察与玩法交流。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →