inclusionAI 开源视觉模型 Ling-3.0-flash-VL,BF16 与 FP8 权重已放出
FellMentKE · x · 2026-09-09
蚂蚁集团旗下 inclusionAI 将视觉语言模型 Ling-3.0-flash-VL 开源,现已在 Hugging Face 和 ModelScope 提供 BF16 与 FP8 权重,FP4、INT4 等更多量化版本即将推出。
- 能力定位:不止于视觉识别,能理解图像、视频、文档与 UI,并进行推理、搜索、验证、调用工具、检查结果,输出最终结果,构成完整的「视觉到行动」闭环。
- 实用演示:手机摄像头下可识别物体与环境、朗读场景描述、翻译外语路牌,适用于旅行、跨语言沟通和无障碍场景。
- 无代码视觉编辑:可选中并移除过期促销元素、替换错误字体、参照站点重排页面样式。
开发者可直接下载权重审查并在自己的工作流中测试。
所属事件:蚂蚁开源视觉语言模型 Ling-3.0-flash-VL(2 条相关)→
「模型」频道最新
- 研究员自曝押中:纳维-斯托克斯将成首个失守的千禧年大奖 — geoffreyirving · 2026-09-09
- Reddit 观点:单看上下文窗口内,模型已比任何个人聪明 — sir_codes_alot · 2026-09-09
- littmath 谈模型为何先破 Navier-Stokes 而黎曼猜想更难 — littmath · 2026-09-09
- OpenAI 内部模型攻克开放数学题:人类此前在该基准上得分为零 — stevenheidel · 2026-09-09
- GPT-6 Astra 登顶 Design Arena 3D 设计榜,Elo 1495 领先 Kimi K3 达 65 分 — airesearch12 · 2026-09-09
- 网友推算:若 NS 证明需人类数年,内部模型时间跨度或达数十年 — Realistic_Stomach848 · 2026-09-09