视觉智能体新样本:Ling-3.0-flash-VL 看图改代码还能实时视频辅导

FellMentKE · x · 2026-09-05

这篇帖子介绍 Ling-3.0-flash-VL 这类视觉智能体的愿景:模型能研究截图、改进自身代码、操作 GUI,甚至基于实时视频进行辅导。作者称其将视觉理解转化为行动,可应用于设计、自动化和学习三类场景。原帖为导览式简介,具体性能数据与实测细节需看原线程。

所属事件:蚂蚁发布Ling-3.0-flash-VL视觉智能体模型(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →