开源视觉模型 Ling-3.0-flash-VL 上线 OpenRouter 并开源 FP4/INT4 版本
FellMentKE · x · 2026-09-11
InclusionAI 的 Ling 3.0 Flash VL 有两项更新:
- 上线 OpenRouter:提供两周免费使用,无需本地部署,可直接调 API 搭建多模态应用与视觉 Agent 工作流;模型基于 Ling 3.0 Flash(124B 总参/5.5B 激活的 MoE),新增原生视觉感知与视觉 Agent 能力,支持即时/推理混合模式与工具调用,262K 上下文。
- 开源 FP4 与 INT4 量化版本(Hugging Face 可下载),便于开发者在不同算力与硬件约束下部署,控制成本。
官方还演示了足球集锦场景:搜索完整比赛时间线、定位进球、提取并验证关键片段、合成可分享的完整集锦。
「多模态」频道最新
- WorldAgents 论文:25 分钟生成一个 3D 场景,每模型仅几欧元 — ducha_aiki · 2026-09-11
- SCAIL2 让角色进入视频实测:需先用 Flux2Klein 对齐起始帧 — lavinia12345 · 2026-09-11
- 全本地流水线做视频:5090+4090 工作站跑通 Qwen 全家桶 — awitod · 2026-09-11
- 分段生成法治 Img2Video 鬼影:3 段 4 秒比 1 段 12 秒更好还快一倍 — Key_Education4018 · 2026-09-11
- 面部捕捉系统v3取得进展,实时人脸重建现曙光 — andrew_n_carr · 2026-09-11
- 单词即出图:Midjourney 提示词系列用苏格兰词 Smeddum 生成风格图 — tisch_eins · 2026-09-11