Apertus 1.5 是支持图像和语音的欧洲 70B 基座模型
AxSaucedo · x · 2026-07-27
欧洲 70B 基座模型 Apertus 1.5 增加原生图像与语音能力
这条帖称,ETH Zurich、EPFL 和瑞士国家科学基金会发布了 Apertus 1.5,这是一个来自欧洲的 70B 基座模型,并且支持原生图像理解和语音处理。
配图还给出了它在 33 个图像基准上的视觉表现对比:
- Apertus 1.5 8B:55.0
- Apertus 1.5 70B:53.6
- Qwen 3 VL 8B:61.7
- Gemma 4 12B:57.1
- Molmo 2 8B:57.1
- Gemma 3 27B:53.1
- Pixtral 12B:50.6
- EuroVLM 9B:46.4
帖子整体是在强调:欧洲正在密集推出自己的基础模型,而 Apertus 1.5 是其中一个带多模态能力的重要节点。
「多模态」频道最新
- Grok Imagine 被赞视频更自然且同步生成音频 — XFreeze · 2026-07-27
- 设计师整理 FLUX 和 ComfyUI 入门教程 — Masha-AI · 2026-07-27
- 游戏本跑图太慢?本地与云端图像生成算力成本探讨 — Simple-Evidence-9125 · 2026-07-27
- Midjourney 新风格把人物变成蓝橙烟雾笔触 — azed_ai · 2026-07-27
- Zombie Genesis 预告片像一支 AI 末世电影概念片 — HomeRemedyHealer · 2026-07-27
- 有人把 AI 3D 工作流称作“TikZ 独角兽”的下游产物 — emollick · 2026-07-27